專欄 AI 管理編年史 第 87/217 講 查看課程目錄

xAI 發表旗艦模型 Grok 3,馬斯克稱訓練算力達前代10倍

17/02/2025 199
3:21
xAI 發表旗艦模型 Grok 3,馬斯克稱訓練算力達前代10倍

xAI 於2025年2月17日發表新一代旗艦模型 Grok 3,訓練運算量為 Grok-2 的10倍,官方宣稱在數學推理與科學測驗上超越 GPT-4o,同時推出輕量版 Grok 3 mini。

xAI 於2025年2月17日發表新一代旗艦模型 Grok 3。執行長馬斯克表示,Grok 3 的訓練運算量是前代 Grok-2 的10倍,使用內含約20萬張 GPU 的 Colossus 資料中心訓練而成——這是目前業界公開規模最大的單一訓練叢集之一。官方宣稱 Grok 3 在 AIME 數學推理與 GPQA 博士級科學題目等基準測試上超越 OpenAI 的 GPT-4o。同時 xAI 也發表輕量版 Grok 3 mini,以犧牲部分準確度換取更快的回應速度,鎖定需要即時互動的應用情境。初期 Grok 3 僅開放給 X 平台 Premium+ 與 xAI 的 SuperGrok 訂閱用戶使用,企業 API 存取則預告稍後開放。

技術意義:算力堆疊仍是這一階段的主戰場

Grok 3 最引人注目的不是功能創新,而是「10倍算力」與「20萬張 GPU 叢集」這兩個數字本身。這說明截至2025年初,頭部 AI 公司的競爭仍高度依賴運算規模的擴張,而非單純的演算法巧思。Colossus 資料中心的規模也重新定義了「旗艦模型」的入場門檻——能砸下如此算力的公司屈指可數。

與競品比較:直接對標 GPT-4o 的基準測試策略

xAI 選擇在 AIME(數學)與 GPQA(博士級科學)這兩項高難度推理基準上與 GPT-4o 正面比較,顯示 Grok 3 的定位是「推理能力」而非泛用對話體驗。同時推出的 Grok 3 mini 則是對應 OpenAI o3-mini、Google Gemini Flash 等「輕量高速」模型路線的市場區隔——顯示各家廠商已普遍採用「旗艦版+輕量版」雙軌策略。

業界反應:訂閱牆先行、企業市場後補

Grok 3 初期只綁定 X Premium+ 與 SuperGrok 訂閱,而非立即開放 API,這與 OpenAI、Anthropic 慣用的「先開 API 搶開發者」策略不同,反映 xAI 更倚重馬斯克旗下 X 平台的既有用戶基礎做為初期導流管道,企業級應用要等後續開放才能評估。

對管理者的意義

對管理者而言,這則新聞的訊號不在於「該不該換用 Grok」,而在於提醒:AI 模型的能力仍在快速迭代,且不同廠商正走向「旗艦+輕量」雙軌供應,管理者評估導入 AI 工具時,應同時比較高階推理需求與日常快速回應需求,避免只鎖定單一模型或單一廠商。

適用產業: 製造業 電商社群銷售
測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 Anthropic 發表 Claude 3.7 Sonnet 與 Claude Code:首個「混合推理」模型登場

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策