專欄 AI 管理編年史 第 228/303 講 查看課程目錄

Grok Imagine Image 2.0 上線:區域級精準編輯、單次吃 5 張參考圖,xAI 自稱 Arena 雙榜第二

28/08/2026 256
4:18
Grok Imagine Image 2.0 上線:區域級精準編輯、單次吃 5 張參考圖,xAI 自稱 Arena 雙榜第二
圖/Photo by Emily Bernal on Unsplash

SpaceXAI(原 xAI)於 2026 年 8 月 7 日推出影像生成模型 Grok Imagine Image 2.0,主打魔術棒區域編輯、分割選取、去背透明輸出與最多 5 張參考圖合成,已在 grok.com/imagine 與 iOS/Android App 開放。xAI 自稱在 Arena 文生圖與圖像編輯雙榜排名世界第二,僅次於 OpenAI gpt-image-2。API 官方僅稱 coming soon,未給日期、未公布定價。

SpaceXAI(原 xAI)於 2026 年 8 月 7 日推出影像生成模型 Grok Imagine Image 2.0,並已在 grok.com/imagine 網頁版與 iOS、Android App 上開放。要先講清楚的是:這是影像生成模型的一次版本升級,不是語言模型換代——xAI 目前對外的旗艦語言模型仍是 2026 年 7 月 8 日開放的 Grok 4.5。

這次到底升級了什麼

官方揭露的能力,重心明顯從「生成一張新圖」移到「把既有的圖改到能用」:

  • 魔術棒區域編輯:圈出畫面局部下指令修改,不必整張重新生成,原本滿意的部分得以保留。
  • 分割選取:模型自動辨識物件邊界,可單獨挑出主體或背景來處理。
  • 去背與透明輸出:直接產出可疊圖的透明素材。
  • 多圖參考:單次最多可放入 5 張參考圖,做風格延續或元素合成。
  • 九種長寬比智慧改尺寸:同一張主視覺換版位時不必重排重拍。
  • 產品照、大頭照等預設模板,把常見用途變成一鍵起手式。
  • 針對文字排版與版面渲染最佳化:海報、包裝、廣告圖上的文字更能正確呈現,這一直是影像模型最容易出錯的地方。

至於參數量、訓練資料與解析度上限,官方並未公布,目前無從查證。

Arena 雙榜第二,該怎麼讀

xAI 自稱 Image 2.0 在 Arena 的「文字生成圖片」與「圖像編輯」兩張榜單同列世界第二,第一名為 OpenAI 的 gpt-image-2;xAI 在 Arena 上以 SpaceXAI 名義掛牌。這個成績是廠商自評引用,讀的時候要記得兩件事:

  • 排名來自使用者盲測投票,反映的是「多數人覺得哪張比較好看」,未必等同於你們品牌指定風格下的表現。
  • 榜單本身不會告訴你第一名與第二名的差距,在你的實際用途上是否真的有感。

更值得注意的是敘事位置的改變。從 2026 年初的 Grok Imagine API、1.0 影片生成,到 6 月音畫同步的 Video 1.5,xAI 的影像線一路以便宜、快、能動取勝;Image 2.0 則第一次把主張放在編輯精度與可用性上——這是從玩具往生產工具移動的訊號。

消費端先行,API 只說 coming soon

限制必須說清楚:目前只有消費端可用,也就是 grok.com/imagine 網頁與手機 App,開發者還不能串接。官方對 API 僅表示 coming soon,沒有給出日期,也未公布任何定價與方案。換句話說,現在能做的是讓人打開瀏覽器手動使用,還不能把它接進商品上架流程或素材管線。

對管理者的意義

對行銷、電商、社群團隊而言,去背、換背景、把主視覺改成九種版位,過去多半得外包或用專業軟體,現在對話就能完成,素材產製的分工與成本結構會直接改變——值得先讓小組實測一週,量出「一張素材從需求到可用」的時間差再談導入。同時,這則新聞也示範了一個評估紀律:好用不等於可整合。消費端先行、API 後到的出貨節奏在 AI 產業已成常態,導入前務必先確認有沒有 API、什麼時候有、價格多少,否則做出來的流程只能靠人手動搬檔案,規模一放大就垮。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 OpenAI 發布資安專用模型 GPT-5.6-Cyber,Daybreak 計畫拆成 Blue/Red 兩層存取

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策