Topic
#ai-image-generation
按主题聚合的新闻视图。
Topic Feed
主题:ai-image-generation
共 9 条

xAI 的 Imagine Image 2.0 紧随 GPT-Image-2
xAI 在 grok.com/imagine 以及 Grok 的 iOS 和 Android 应用中上线了 Imagine Image 2.0 作为新的“质量模式”,并表示 API 访问即将到来。公司称该模型加入了编辑工具、模板,以及更强的指令遵循能力。

Qwen-Image-3.0提升文字型图像生成
阿里巴巴的Qwen团队发布了Qwen-Image-3.0,这是一款面向密集排版、小字号文字、公式和多语言内容的一次性图像生成模型。该模型目前仅通过邀请制API提供访问,后续计划尽快接入Qwen自家应用。

Meta 的 Muse Image 表现亮眼,但隐私引发争议
Meta 发布了 Muse Image,这是其 Superintelligence Labs 推出的首个图像生成模型,并且它以智能体方式工作,能够调用工具、运行代码并自动优化输出。与此同时,Meta 还预览了 Muse Video,并推出一项基于 Instagram 的功能,用户可以通过公开账号用户名在未获同意的情况下生成相关人物的 AI 图像。

Nano Banana 2 Lite 发布
Simon Willison 介绍了谷歌的 Nano Banana 2 Lite,也就是 Gemini 3.1 Flash Lite Image(`gemini-3.1-flash-lite-image`),把它描述为一款速度快、成本低的 Gemini 图像模型。他还展示了它生成的一张“寻找威利”风格图片,画面里有一只拿着对讲机的浣熊。

谷歌推出 Nano Banana 2 Lite:更快更便宜的图像生成模型
Google DeepMind 发布了 Nano Banana 2 Lite,也就是 Gemini 3.1 Flash Lite Image,并已在谷歌生态中开放使用。谷歌称它在低思考模式下生成图像大约只需 4 秒,是目前最快三、也最便宜的图像模型。

微软MAI-Image-2.5追平Nano Banana 2
微软发布了最新的图像生成模型 MAI-Image-2.5,并表示它目前在 Arena 的文本到图像排行榜上位列第三。微软称它已经与谷歌的 Nano Banana 2 处于同一水平,但仍落后于 OpenAI 的 Image-2。

Luma开放Uni-1.1图像API
Luma已通过REST API发布其Uni-1.1图像模型,支持文本生成图像和图像编辑。公司表示该API提供两个档位,并将价格与质量定位为可与OpenAI和Google竞争。

ChatGPT 图像 2.0 模型在图像中生成真实文本方面表现优异
ChatGPT 新版图像生成模型 Images 2.0 显著提升了图像中文字的可读性和真实性,例如餐厅菜单,这曾是 AI 图像生成器的一大短板。

Gemini 现在可接入 Google 相册生成个性化 AI 图像
Google Gemini 现在通过个人智能功能将 AI 图像生成器与 Google 相册连接,使用户能基于自己的照片库和标签生成更个性化的图像。