Grok Image 2 是什么?
Grok Image 2 是 xAI 官方 Imagine Image 2.0 的常用搜索名称。模型于 2026 年 8 月 7 日作为新版 Quality Mode 上线 Grok 网页端、iOS 和 Android,覆盖图像生成与针对性编辑。
Grok Image 2 是 xAI 在 Grok 网页端、iOS 与 Android 推出的新版 Quality Mode。本站为独立资料与工作区;在 Grok Image 2 API 尚未开放期间,生成器调用当前公开的 Grok Imagine API。

独立工作流示意
生成 · 编辑 · 参考图 · 智能扩图
xAI 表示 Grok Image 2 会规划文字与版式,使高密度、多区域画面保持结构,小字更清晰。重要文字仍应在发布前人工校对。
消费端增加魔棒局部编辑、分割选区、透明背景导出和多参考图编辑;目标是改动指定内容,同时尽量保留其他区域。
Grok Image 2 已公布 9 种智能扩图比例,从 1:2、9:16 到 16:9、2:1;不是简单裁切,而是补全新画幅。
是什么 · 为什么 · 怎么用
先分清已经发布的产品、能力依据和正确测试方法。Image 2.0 消费端能力与当前 Grok Imagine API 有关联,但不能混为一谈。
Grok Image 2 是 xAI 官方 Imagine Image 2.0 的常用搜索名称。模型于 2026 年 8 月 7 日作为新版 Quality Mode 上线 Grok 网页端、iOS 和 Android,覆盖图像生成与针对性编辑。
这次发布把文字与版式规划、选区编辑、消费端 5 张参考图、透明背景和 9 种智能扩图比例放进同一流程。xAI 还公布了发布日在两个 Arena 榜单列第 2;这是带日期的官方说法,不是独立测评。
体验正式 Grok Image 2 应使用 Grok Quality Mode。提示词写可检查的约束,参考图只保留明确用途,优先编辑最小区域,并复核文字和几何细节。本站在 xAI 开放 Image 2 API 前调用当前公开 Grok Imagine API。
可核验的 Grok Image 2 更新集中在指令遵循、文字与版式规划、局部编辑、多参考图和智能扩图。以下内容会把消费端 Image 2.0 与当前开发者 API 分开说明。
Grok Image 2 强调同时保持多段要求、文字层级与版式关系。提示词应写主体、必现文字、位置、风格和禁改项,不要只堆“高级”“震撼”等形容词。
当主体已正确、只需修改一个物体、颜色或区域时,可用局部编辑或分割选区,减少整图重做带来的漂移。
Grok Image 2 消费端一次最多接受 5 张输入图;本站调用的当前 API 文档为最多 3 张,因此上传控件采用更低上限。
背景移除可导出透明主体。用于生产前,应放大检查发丝、玻璃、布料、软阴影与半透明边缘。
xAI 展示了 1:2、9:16、2:3、3:4、1:1、4:3、3:2、16:9 和 2:1。模型补齐新画幅,而非只做裁切。
Grok Image 2 API 在发布时尚未开放。本站调用已公开的 Grok Imagine 模型,不会把这些结果冒充为 Image 2 输出。
要体验正式发布的 Grok Image 2,应使用 Grok Quality Mode。本站为独立工作区,在 xAI 开放 Grok Image 2 API 前,生成与编辑由当前 Grok Imagine API 完成。
明确主体、构图、图内文字、视觉风格、比例与不可改内容。具体约束比“高质量”“专业感”更容易检查。
参考图分别承担人物、产品形态、配色或版式作用。本站最多 3 张;Grok Image 2 消费端最多 5 张。
其余部分已正确时,优先选局部或分割对象。检查人脸、文字、Logo、手指、产品几何与透明边缘。
只生成渠道真正需要的比例,对比不同版本中的主体保真度,并把通过审核的提示词与参考图和成品一起保存。
X 公开帖子
以下公开 X 帖子核验于 2026 年 8 月 9 日。入选帖子都描述了具体生成、对比或编辑体验,并同时保留正面、混合和批评反馈。
“Grok Image 2 is impressive. Generate an image, inspect its selectable segments, then edit, regenerate or animate from one surface.”
作者强调从生成结果、可选分区到编辑、重生成和动画的一体化操作流程。
Simone
@mustbesimo ·
“生图:细节以及对于世界理解能力还是gpt强 编辑:审美gpt稍微占一些优势,但是图像编辑能力Grok强 中文小字:两者都没有任何问题”
完成 7 组对比后,作者认为 GPT 的生图细节和审美稍占优,Grok 的图像编辑更强、快速出图更合适。
码农暖爸
@Delroy715 ·
“Grok 直出效果已经很能打,质感、光影、氛围都在线。短板是复杂细节容易糊,精细度还不如 GPT Image 2。”
作者认可直出质感、光影、氛围和局部编辑,同时指出复杂细节容易模糊。
羊羊羊
@encryptjustice ·
“Have a coffee-making scene and delete the coffee art from ONE spot? It deletes every single coffee art instance across the entire image.”
作者报告了一个具体缺陷:删除一处重复元素时,画面中的同类元素也被全部删除。
Silverion Stormbringer
@Lord_Silverion ·
这些内容是个人体验,不是可复现基准,也不能证明模型的普遍质量。引文保留原语言并直接链接原帖;作者之后可能编辑或删除帖子。Grok Image 2 仍应使用自己的提示词和验收标准测试。
核验 Grok Image 2 的上线范围、编辑工具、参考图、智能扩图、榜单与当前 API 状态。
Grok Image 2 是用户常搜的名称,xAI 官方发布名为 Imagine Image 2.0。xAI 将它定位为精确图像生成与编辑模型,并于 2026 年 8 月 7 日作为新版 Quality Mode 在 Grok 网页端、iOS 与 Android 正式上线。
官方发布页列出 grok.com/imagine、Grok iOS 和 Android 应用。这里的“可用”指消费端 Quality Mode;本站为独立服务,并非 xAI 官方产品。
发布时没有。xAI 页面明确写着 API access is coming soon。本站生成器使用现有的 grok-imagine-image-quality 与 grok-imagine-image API,不调用未公开端点。
xAI 表示模型会规划文字与版式,让高密度、多区域画面保持结构,小字更清晰。这是能力方向,不是零错误保证;姓名、数字、标签和法律文本都应逐项校对。
消费端提供魔棒局部编辑和分割选区,用于精确指定要改的区域。官方目标是改动指定内容,同时保留其他区域。
Image 2.0 消费端一次最多接受 5 张输入图。当前 Grok Imagine API 文档最多 3 张,因此本站上传上限为 3 张。
可以。xAI 把透明背景导出列为 Grok Image 2 编辑工具。使用前仍应检查细边缘和半透明材质。
官方展示了 1:2、9:16、2:3、3:4、1:1、4:3、3:2、16:9 与 2:1。智能扩图会补齐新增画面,不只是裁掉原图。
xAI 表示该模型在 2026 年 8 月 7 日的 Text-to-Image Arena 和 Image Edit Arena 总体 Elo 中均列世界第 2。榜单会变化,应同时保留日期和快照语境。
xAI 列出照片编辑、产品换色、产品海报、拼贴、吉祥物、背景修改、电商图、UGC 图、人像、图标、角色精灵、UI 素材、Emoji 与周边设计等流程。
发布页展示了分别生成角色、地点和道具,同时保持同一视觉风格。实际项目仍应复用同一组参考图与明确的风格约束,并逐张检查。
本站通过 xAI 公开 API 提供 Grok Imagine Quality 与 Grok Imagine。只有在 xAI 发布 Grok Image 2 API 模型标识和访问规则后,才会切换到 Image 2。
官方文档涵盖文生图、自然语言编辑、批量输出、比例控制、1K/2K 输出与参考图输入;具体能力和价格取决于所选 API 模型。
xAI 列出的 Grok Imagine Quality 价格为 1K 输出每张 0.05 美元、2K 每张 0.07 美元,参考图另计输入费;Grok Imagine 输出每张 0.02 美元。本站积分与订阅费另行计算。
没有。grokimage2.app 是 Grok Image 2 的独立资料与工作区。Grok、Grok Imagine 与 Imagine Image 2.0 均为 xAI 名称,模型信息以 xAI 官方来源为准。
用当前 Grok Imagine API 生成或编辑,保存提示词和参考图,并在使用前逐项核对。Grok Image 2 API 仍待 xAI 开放。