xAI發表Grok 4 Fast:思考token省40%、價格降98%,免費用戶首度用上旗艦模型
xAI於2025年9月19日發表Grok 4 Fast,統一架構整合推理與非推理模式,200萬token上下文並內建即時網頁與X平台搜尋,效能接近Grok 4但思考token省40%、價格降98%,即日起免費用戶也能不受限使用。
xAI於2025年9月19日發表新一代推理模型Grok 4 Fast,主打「成本效益」定位。這款模型採用統一架構,將原本分開的推理模式(reasoning)與非推理模式(non-reasoning)融合到同一個模型中,由模型自行判斷何時該深入思考、何時可直接作答,不需使用者手動切換。Grok 4 Fast同時具備200萬token的超長上下文窗口,並內建即時網頁搜尋與X平台(原Twitter)搜尋能力,可直接抓取最新資訊作答,而非僅依賴訓練時的靜態知識。
官方公布的效能數據顯示,Grok 4 Fast在多項基準測試中的表現與前代旗艦Grok 4相近,但平均只需少40%的思考token即可達到同等效能。搭配大幅降低的定價,整體使用成本較Grok 4下降達98%。更關鍵的是,xAI宣布Grok 4 Fast即日起開放給所有使用者,包含免費帳號,這是免費用戶首次能不受限制使用xAI的最新旗艦等級模型。
統一架構:省下的不只是錢,是「思考的浪費」
過去多數推理模型必須在「快但淺」與「慢但深」之間讓使用者手動選擇,容易發生兩種浪費:簡單問題被丟進慢速推理模式空耗算力,或複雜問題被誤放進快速模式導致答錯。Grok 4 Fast把判斷權交還給模型本身,由系統依問題難度動態決定思考長度,這也是官方所稱「思考token省40%」的技術來源——省下的不是省略步驟,而是省略了不必要的思考。
與同期競品的定位差異
相較於2025年8月推出、強調頂尖推理能力的GPT-5、Claude Opus 4.1,Grok 4 Fast策略明顯是「夠好且夠便宜」,對準日常高頻率、輕量查詢,而非追求跑分紀錄。內建即時搜尋讓它在「時效性問題」上具備原生優勢,這是依賴靜態訓練資料的模型較弱的一環。98%的價格降幅意味著同樣預算下可執行的查詢量大增,對客服機器人、內容審核等高頻AI應用而言,成本結構出現質變。
「AI民主化」的實質意義
業界普遍將Grok 4 Fast免費開放解讀為xAI「AI民主化」策略:降低使用門檻,讓一般用戶也能接觸近旗艦等級的AI能力,擴大使用者基數,也對仍將旗艦模型鎖在付費牆後的競爭對手形成壓力,「先普及、後變現」的路徑與部分同業堅持高階訂閱制形成對比。
對管理者而言,這則新聞的意義不在於哪家模型跑分最高,而在於AI使用成本正快速逼近「可忽略不計」的臨界點:當推理等級AI幾乎免費、又能即時查證最新資訊,企業內部原本因成本或授權而卡關的AI導入計畫,此時值得重新評估是否已具備規模化的條件。
大家怎麼說 · 5 則留言