xAI發表Grok 4.1與Grok 4.1 Fast:兩週靜默測試後的推理與代理能力升級
xAI於11月17日發表Grok 4.1,強化推理、多模態與情感智慧並降低幻覺率,先經兩週靜默測試才公開;同步推出主打代理式工作流、支援200萬token上下文的Grok 4.1 Fast。
2025年11月17日,馬斯克旗下人工智慧公司xAI正式發表新一代模型Grok 4.1,同時推出鎖定工具調用與代理式工作流的Grok 4.1 Fast版本。這是Grok系列的增量升級,重點放在強化推理能力、多模態理解、人格與情感智慧表現,並降低事實性幻覺的發生率。值得注意的是,Grok 4.1並非直接倉促上線——xAI先於11月1日至14日這兩週進行「靜默上線」測試,讓模型在grok.com、X平台等既有流量中與使用者實際互動,透過即時盲測比較蒐集回饋,再依結果微調模型行為,才在11月17日正式公開。目前Grok 4.1已開放給grok.com網站、X平台以及iOS/Android App的所有使用者使用。
兩週靜默測試:先在真實對話中校準
過去大型語言模型多半是內部評測通過即公開發表,使用者的真實反應要等上線後才知道。Grok 4.1這次改採「靜默上線」(stealth launch)做法:新模型先悄悄混入既有流量,與使用者在不知情下互動,再用盲測比較蒐集偏好回饋,據此微調語氣、回答風格與行為,最後才掛上「Grok 4.1」名稱正式發表。這種先試跑、再依回饋校準才定案的流程,讓官方能用真實反應把模型調到位,而非單靠內部基準分數——這也是xAI特別強調此版本「人格與情感智慧」有感提升、且事實性幻覺發生率降低的原因,這類體驗本就難靠靜態評測衡量。
Grok 4.1 Fast:200萬token與Agent Tools API,代理式工作流成焦點
與強調對話品質的Grok 4.1不同,同步發表的Grok 4.1 Fast鎖定工具調用與代理式工作流(agentic workflow)場景。它支援高達200萬token的超長上下文窗口,可一次餵入大量文件、對話紀錄或程式碼庫而不需頻繁分段;搭配的Agent Tools API,讓模型能協調網路搜尋、網頁存取、程式執行等外部工具,完成需多步驟操作的任務,而非只被動回答單一問題。這代表xAI此次同時照顧兩種需求:一般使用者要更自然、更少出錯的對話(Grok 4.1本體),開發者與企業要能整合進自動化流程的「代理」(Grok 4.1 Fast),也呼應了業界從單純問答轉向自主呼叫工具、串接多步驟任務的共同趨勢。對管理者而言,這次更新真正值得留意的是:AI工具正從「回答問題」進化到「能被交辦連續性任務」,若團隊正評估把AI導入客服應答、資料彙整或查資料跑流程的重複性工作,這類技術基礎已值得列入下一輪工具評估觀察。