Grok Imagine Image 2.0 上线:区域级精准编辑、单次可用 5 张参考图,xAI 自称 Arena 双榜第二
SpaceXAI(原 xAI)于 2026 年 8 月 7 日推出图像生成模型 Grok Imagine Image 2.0,主打魔术棒区域编辑、分割选取、抠图透明输出与最多 5 张参考图合成,已在 grok.com/imagine 与 iOS/Android App 开放。xAI 自称在 Arena 文生图与图像编辑双榜位列世界第二,仅次于 OpenAI gpt-image-2。API 官方仅称 coming soon,未给日期、未公布定价。
SpaceXAI(原 xAI)于 2026 年 8 月 7 日推出图像生成模型 Grok Imagine Image 2.0,并已在 grok.com/imagine 网页版与 iOS、Android App 上开放。需要先讲清楚:这是图像生成模型的一次版本升级,不是语言模型换代——xAI 目前对外的旗舰语言模型仍是 2026 年 7 月 8 日开放的 Grok 4.5。
这次到底升级了什么
官方披露的能力,重心明显从「生成一张新图」转到「把已有的图改到能用」:
- 魔术棒区域编辑:框出画面局部下指令修改,不必整张重新生成,原本满意的部分得以保留。
- 分割选取:模型自动识别物体边界,可单独挑出主体或背景处理。
- 抠图与透明输出:直接产出可叠图的透明素材。
- 多图参考:单次最多可放入 5 张参考图,做风格延续或元素合成。
- 九种长宽比智能改尺寸:同一张主视觉换版位时不必重排重拍。
- 产品图、证件照等预设模板,把常见用途变成一键起步。
- 针对文字排版与版面渲染优化:海报、包装、广告图上的文字更能正确呈现,这一直是图像模型最容易出错的地方。
至于参数量、训练数据与分辨率上限,官方并未公布,目前无从查证。
Arena 双榜第二,该怎么读
xAI 自称 Image 2.0 在 Arena 的「文生图」与「图像编辑」两张榜单同列世界第二,第一名为 OpenAI 的 gpt-image-2;xAI 在 Arena 上以 SpaceXAI 名义挂牌。这个成绩是厂商自评引用,读的时候要记住两件事:
- 排名来自用户盲测投票,反映的是「多数人觉得哪张更好看」,未必等同于你们品牌指定风格下的表现。
- 榜单本身不会告诉你第一名与第二名的差距,在你的实际用途上是否真的有感。
更值得注意的是叙事位置的变化。从 2026 年初的 Grok Imagine API、1.0 视频生成,到 6 月音画同步的 Video 1.5,xAI 的图像线一路以便宜、快、能动取胜;Image 2.0 则第一次把主张放在编辑精度与可用性上——这是从玩具向生产工具移动的信号。
消费端先行,API 只说 coming soon
限制必须讲清楚:目前只有消费端可用,也就是 grok.com/imagine 网页与手机 App,开发者还不能接入。官方对 API 仅表示 coming soon,没有给出日期,也未公布任何定价与方案。换句话说,现在能做的是让人打开浏览器手动使用,还不能把它接进商品上架流程或素材管线。
对管理者的意义
对营销、电商、社群团队而言,抠图、换背景、把主视觉改成九种版位,过去多半得外包或用专业软件,如今对话就能完成,素材生产的分工与成本结构会直接改变——值得先让小组实测一周,量出「一张素材从需求到可用」的时间差再谈引入。同时,这则新闻也示范了一条评估纪律:好用不等于可集成。消费端先行、API 后到的出货节奏在 AI 行业已成常态,引入前务必先确认有没有 API、什么时候有、价格多少,否则做出来的流程只能靠人手动搬文件,规模一放大就垮。