产业 / 媒体
xAI 发布 Imagine Image 2.0,文生图与图像编辑双双跻身全球第二
马斯克旗下 xAI 于 2026 年 8 月 8 日正式发布 Imagine Image 2.0 模型,并以「质量模式」形式上线 Grok.com 网页端及 iOS、安卓客户端。新模型在指令遵循、文字排版规划和多轮编辑一致性方面均有显著提升,同时引入魔棒工具、精确分割、背景移除、多参考图输入(最多 5 张)以及智能调整尺寸等五项编辑功能,以应对真实创作场景中反复修改的需求。性能评测方面,根据 xAI 引用的 Arena 文生图与图像编辑排行榜数据,截至 2026 年 8 月 7 日,Image 2.0 在两项指标上均位列全球第二,仅次于 OpenAI 的 GPT Image 2。该模型针对摄影、设计和插画三大场景专项训练,标志着 xAI 在视觉生成领域的竞争力进一步跃升。
马斯克旗下 xAI 于 8 月 8 日正式推出 Imagine Image 2.0,作为 Grok 平台的全新「质量模式」向用户开放。该模式已同步上线 Grok.com 网页版、iOS 及安卓应用,用户无需额外操作即可切换使用。此次发布是 xAI 在视觉生成赛道的一次重要升级,也是继 Grok 语言模型系列之后,该公司在多模态能力上的集中发力。
在生成质量层面,Image 2.0 对指令遵循能力进行了深度优化。模型能够理解并执行细节层面的用户要求,在包含多个视觉元素的复杂画面中,会主动规划文字排版与版式结构,确保各部分画面风格统一。此外,小字号文字的清晰度也得到明显改善,这对需要在图像中嵌入文案的设计场景尤为实用。
编辑能力是 Image 2.0 此次升级的核心重点。xAI 指出,真实创作流程中首张生成图几乎不会直接成为最终成品,多轮修改才是常态。为此,模型内置了魔棒工具(仅对用户指定区域进行修改)、精确分割功能、背景移除工具(可导出透明背景主体)以及多参考图编辑(单次最多输入 5 张图像),大幅降低了手动合成的工作量。
智能调整尺寸功能同样值得关注。用户只需选定目标比例,模型便会自动补全画面框架,使同一张图能够适配不同平台和尺寸需求。这一功能对社交媒体运营、广告投放等需要多尺寸素材的场景具有较强的实用价值,减少了重复生成带来的时间成本。
在第三方评测数据方面,根据 xAI 引用的 Arena 文生图与图像编辑排行榜,截至 2026 年 8 月 7 日,Image 2.0 在两项能力上均排名全球第二,仅次于 OpenAI 的 GPT Image 2。该模型针对摄影、设计和插画三大垂直场景进行了专项训练,在专业创作领域的表现尤为突出,显示出 xAI 在视觉 AI 赛道上与头部玩家正面竞争的实力与野心。
要点
- Imagine Image 2.0 以「质量模式」形式上线 Grok 全平台,支持网页端、iOS 和安卓同步使用。
- 新增魔棒编辑、精确分割、背景移除、多参考图输入(最多 5 张)及智能扩图五项编辑工具,覆盖真实创作中的多轮修改需求。
- 根据 Arena 排行榜数据,Image 2.0 在文生图生成与图像编辑两项指标上均位列全球第二,仅次于 OpenAI GPT Image 2。
- 模型针对摄影、设计、插画三大场景专项训练,在复杂排版和小字号文字清晰度上有明显提升。
原始标题:全球第二:马斯克 SpaceXAI 推出 Imagine Image 2.0,强化 AI 生图 / 编辑能力
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。