專欄 AI 管理編年史 第 283/303 講 查看課程目錄

xAI 正式發布 Grok 4.7:程式設計與知識工作旗艦,價格與 4.6 相同、API 與 App 即日可用

21/09/2026 203
4:05
xAI 正式發布 Grok 4.7:程式設計與知識工作旗艦,價格與 4.6 相同、API 與 App 即日可用
圖/Photo by Fatemeh Rezvani on Unsplash

xAI 於 2026 年 9 月 21 日推出 Grok 4.7,官方稱其為「最強的程式設計與知識工作模型」:500k 上下文、四段推理強度、知識截止 2026 年 5 月,價格與 Grok 4.6 完全相同,即日在 API、Cursor、App 與 X 平台開放。

2026 年 9 月 21 日(美國時間週一),xAI 在官方頁面正式發布 Grok 4.7,官方稱其為「最強的程式設計與知識工作模型」。自 9 月初起 Elon Musk 多次預告、又多次延後,這款前一代 Grok 4.6(2026 年 8 月推出)的接班者終於上線,API model ID 為 grok-4.7。

規格方面,Grok 4.7 支援 500k tokens 上下文、文字與圖片輸入,提供 low/medium/high/xhigh 四段推理強度,知識截止日期為 2026 年 5 月。價格與 Grok 4.6 完全相同:提示少於 200k tokens 時,每百萬 tokens 輸入 2 美元、快取輸入 0.5 美元、輸出 6 美元;提示達 200k tokens 以上,整筆改按 4/1/12 美元計費。即日可在 Grok API、Cursor、Grok Build、第三方程式工具、雲平台、iOS/Android App 與 X 平台使用。另有 Grok 4.7 Fast 變體,速度兩倍、價格也兩倍,目前僅限 Cursor 與 Grok Build,尚無獨立公開的 API model ID。

技術意義:更大的基底、更長的強化學習

xAI 說明本代改進來自兩個方向:

  • 更大的基底模型(媒體報導參數約 2.1 兆,但官方頁面並未載明,僅能視為外界推估)。
  • 針對更難的任務組合進行更長時間的強化學習,讓模型在困難任務上能工作更久、更仔細地自我驗證,並更擅長產出文件與簡報。

官方另提到融入 SpaceX 的工程資料做補充訓練。

與前代比較:官方自陳基準的落差

以下皆為官方自陳、尚未經獨立驗證的數字,括號內為 Grok 4.6:

  • CursorBench 4.0:46.3%(40.4%)
  • DeepSWE v1.1:71.0%(65.2%)
  • Terminal-Bench 4.0:38.0%(20.3%)
  • SWE-Marathon v1.1:46.0%(31.9%)
  • EEBench 電機工程:64.0%;Harvey 法律工作:19.6%

Terminal-Bench 幾乎翻倍、SWE-Marathon 大幅提升,指向的是「長時間、多步驟的代理式工程任務」,而非單輪問答。法律工作只有 19.6%,也顯示官方並未把它包裝成全能模型。

安全護欄與值得觀察的兩點

xAI 稱 Grok 4.7 採用全新安全護欄堆疊並強化抗越獄:LatchBio 生物安全基準 62.4%,HackerBench v0.3 僅 3.3% 的高風險雙重用途提示通過。從這則發布,筆者認為有兩點值得觀察:

  1. 「價格不變、能力提升」的定價方式,與本月稍早的 Gemini 3.8 Flash、GPT-6 Astra、DeepSeek V4.1-Flash 形成直接對照。
  2. Fast 變體暫不開放獨立 API,速度優勢目前只在 Cursor 與 Grok Build 內可用。

對管理者的意義

對在泰國管理團隊的主管而言,重點不在參數,而在「同價升級」與「長任務」:既有 Grok 4.6 的用量預算可直接沿用,而模型更適合交付需要多步驟自我驗證的工作,例如把工廠或門市的作業流程整理成文件與簡報。官方基準畢竟是自陳數字,以自家任務實測才是唯一準繩。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 Claude Opus 5.5 正式發布:多數工作達 Fable 5.1 水準、成本比 Opus 5 低 40%

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策