专栏 AI 管理编年史 第 228/303 讲 查看课程目录

Grok Imagine Image 2.0 上线:区域级精准编辑、单次可用 5 张参考图,xAI 自称 Arena 双榜第二

28/08/2026 258
4:18
Grok Imagine Image 2.0 上线:区域级精准编辑、单次可用 5 张参考图,xAI 自称 Arena 双榜第二
图/Photo by Emily Bernal on Unsplash

SpaceXAI(原 xAI)于 2026 年 8 月 7 日推出图像生成模型 Grok Imagine Image 2.0,主打魔术棒区域编辑、分割选取、抠图透明输出与最多 5 张参考图合成,已在 grok.com/imagine 与 iOS/Android App 开放。xAI 自称在 Arena 文生图与图像编辑双榜位列世界第二,仅次于 OpenAI gpt-image-2。API 官方仅称 coming soon,未给日期、未公布定价。

SpaceXAI(原 xAI)于 2026 年 8 月 7 日推出图像生成模型 Grok Imagine Image 2.0,并已在 grok.com/imagine 网页版与 iOS、Android App 上开放。需要先讲清楚:这是图像生成模型的一次版本升级,不是语言模型换代——xAI 目前对外的旗舰语言模型仍是 2026 年 7 月 8 日开放的 Grok 4.5。

这次到底升级了什么

官方披露的能力,重心明显从「生成一张新图」转到「把已有的图改到能用」:

  • 魔术棒区域编辑:框出画面局部下指令修改,不必整张重新生成,原本满意的部分得以保留。
  • 分割选取:模型自动识别物体边界,可单独挑出主体或背景处理。
  • 抠图与透明输出:直接产出可叠图的透明素材。
  • 多图参考:单次最多可放入 5 张参考图,做风格延续或元素合成。
  • 九种长宽比智能改尺寸:同一张主视觉换版位时不必重排重拍。
  • 产品图、证件照等预设模板,把常见用途变成一键起步。
  • 针对文字排版与版面渲染优化:海报、包装、广告图上的文字更能正确呈现,这一直是图像模型最容易出错的地方。

至于参数量、训练数据与分辨率上限,官方并未公布,目前无从查证。

Arena 双榜第二,该怎么读

xAI 自称 Image 2.0 在 Arena 的「文生图」与「图像编辑」两张榜单同列世界第二,第一名为 OpenAI 的 gpt-image-2;xAI 在 Arena 上以 SpaceXAI 名义挂牌。这个成绩是厂商自评引用,读的时候要记住两件事:

  • 排名来自用户盲测投票,反映的是「多数人觉得哪张更好看」,未必等同于你们品牌指定风格下的表现。
  • 榜单本身不会告诉你第一名与第二名的差距,在你的实际用途上是否真的有感。

更值得注意的是叙事位置的变化。从 2026 年初的 Grok Imagine API、1.0 视频生成,到 6 月音画同步的 Video 1.5,xAI 的图像线一路以便宜、快、能动取胜;Image 2.0 则第一次把主张放在编辑精度与可用性上——这是从玩具向生产工具移动的信号。

消费端先行,API 只说 coming soon

限制必须讲清楚:目前只有消费端可用,也就是 grok.com/imagine 网页与手机 App,开发者还不能接入。官方对 API 仅表示 coming soon,没有给出日期,也未公布任何定价与方案。换句话说,现在能做的是让人打开浏览器手动使用,还不能把它接进商品上架流程或素材管线。

对管理者的意义

对营销、电商、社群团队而言,抠图、换背景、把主视觉改成九种版位,过去多半得外包或用专业软件,如今对话就能完成,素材生产的分工与成本结构会直接改变——值得先让小组实测一周,量出「一张素材从需求到可用」的时间差再谈引入。同时,这则新闻也示范了一条评估纪律:好用不等于可集成。消费端先行、API 后到的出货节奏在 AI 行业已成常态,引入前务必先确认有没有 API、什么时候有、价格多少,否则做出来的流程只能靠人手动搬文件,规模一放大就垮。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 OpenAI 发布安全专用模型 GPT-5.6-Cyber,Daybreak 计划拆成 Blue/Red 两层访问

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策