xAI 正式發布 Grok 4.7:程式設計與知識工作旗艦,價格與 4.6 相同、API 與 App 即日可用
xAI 於 2026 年 9 月 21 日推出 Grok 4.7,官方稱其為「最強的程式設計與知識工作模型」:500k 上下文、四段推理強度、知識截止 2026 年 5 月,價格與 Grok 4.6 完全相同,即日在 API、Cursor、App 與 X 平台開放。
2026 年 9 月 21 日(美國時間週一),xAI 在官方頁面正式發布 Grok 4.7,官方稱其為「最強的程式設計與知識工作模型」。自 9 月初起 Elon Musk 多次預告、又多次延後,這款前一代 Grok 4.6(2026 年 8 月推出)的接班者終於上線,API model ID 為 grok-4.7。
規格方面,Grok 4.7 支援 500k tokens 上下文、文字與圖片輸入,提供 low/medium/high/xhigh 四段推理強度,知識截止日期為 2026 年 5 月。價格與 Grok 4.6 完全相同:提示少於 200k tokens 時,每百萬 tokens 輸入 2 美元、快取輸入 0.5 美元、輸出 6 美元;提示達 200k tokens 以上,整筆改按 4/1/12 美元計費。即日可在 Grok API、Cursor、Grok Build、第三方程式工具、雲平台、iOS/Android App 與 X 平台使用。另有 Grok 4.7 Fast 變體,速度兩倍、價格也兩倍,目前僅限 Cursor 與 Grok Build,尚無獨立公開的 API model ID。
技術意義:更大的基底、更長的強化學習
xAI 說明本代改進來自兩個方向:
- 更大的基底模型(媒體報導參數約 2.1 兆,但官方頁面並未載明,僅能視為外界推估)。
- 針對更難的任務組合進行更長時間的強化學習,讓模型在困難任務上能工作更久、更仔細地自我驗證,並更擅長產出文件與簡報。
官方另提到融入 SpaceX 的工程資料做補充訓練。
與前代比較:官方自陳基準的落差
以下皆為官方自陳、尚未經獨立驗證的數字,括號內為 Grok 4.6:
- CursorBench 4.0:46.3%(40.4%)
- DeepSWE v1.1:71.0%(65.2%)
- Terminal-Bench 4.0:38.0%(20.3%)
- SWE-Marathon v1.1:46.0%(31.9%)
- EEBench 電機工程:64.0%;Harvey 法律工作:19.6%
Terminal-Bench 幾乎翻倍、SWE-Marathon 大幅提升,指向的是「長時間、多步驟的代理式工程任務」,而非單輪問答。法律工作只有 19.6%,也顯示官方並未把它包裝成全能模型。
安全護欄與值得觀察的兩點
xAI 稱 Grok 4.7 採用全新安全護欄堆疊並強化抗越獄:LatchBio 生物安全基準 62.4%,HackerBench v0.3 僅 3.3% 的高風險雙重用途提示通過。從這則發布,筆者認為有兩點值得觀察:
- 「價格不變、能力提升」的定價方式,與本月稍早的 Gemini 3.8 Flash、GPT-6 Astra、DeepSeek V4.1-Flash 形成直接對照。
- Fast 變體暫不開放獨立 API,速度優勢目前只在 Cursor 與 Grok Build 內可用。
對管理者的意義
對在泰國管理團隊的主管而言,重點不在參數,而在「同價升級」與「長任務」:既有 Grok 4.6 的用量預算可直接沿用,而模型更適合交付需要多步驟自我驗證的工作,例如把工廠或門市的作業流程整理成文件與簡報。官方基準畢竟是自陳數字,以自家任務實測才是唯一準繩。