Meta 發表 Muse Spark 1.3:agentic 與程式任務強化,價格不變、開放權重仍無期
2026 年 9 月 2 日 Meta 發表 Muse Spark 1.3,主打真實可用性:長時程跨工作流任務、主動澄清、提示注入抗性提升;對照 1.2 工具呼叫少約 20%、token 少約 25%。定價與 1.2 持平,Muse Code 與 Meta Model API 即日可用;max 推理待安全測試,開放權重承諾仍無日期。
2026 年 9 月 2 日,Meta 在 research.meta.ai 部落格發表 Muse Spark 1.3,定位為「強化 agentic 與程式任務、主打真實可用性」的迭代版本。官方列出的重點如下:
- 在單一對話串內可持續跨多個工作流的長時程工作
- 更主動的協作行為:會問澄清問題、卡住時會明說
- 更清楚自身能力邊界
- 對抗性穩健度與提示注入抗性提升
即日起 Muse Code(macOS/Linux)與 Meta Model API 可用,OpenRouter 同步上架。依 Meta 內部對照 Muse Spark 1.2 的說法,1.3 完成同類任務時工具呼叫少約 20%、token 消耗少約 25%,產出的程式碼更乾淨、所需人機互動更少。祖克柏的說法是「以低成本交付前沿效能」。
基準數據:對照 GPT-5.6 Sol 與 Opus 5
官方基準卡以 Muse Spark 1.2、OpenAI GPT-5.6 Sol(max)與 Anthropic Opus 5(max)為對照組。依 Axios 與 Bloomberg 轉述(媒體轉述,非本站實測),Muse Spark 1.3 成績如下:
- MRCR 256K–512K 長文本檢索:98.5
- MRCR 512K–1M 長文本檢索:98.1
- DeepSWE v1.1 軟體工程:75.4
- SWEAtlas CodeBase QnA:59.4
- Terminal-Bench 2.1 終端機任務:88.8
在 1M token 上下文下長文本檢索得分維持在 98 以上,agentic 工程任務亦有 75–88 的成績,是「長時程跨工作流」宣稱的主要支撐。
定價持平,max 推理待安全測試
developer.meta.com 定價頁顯示 1.3 與 1.2 定價相同:輸入每百萬 token $1.25、輸出 $4.25、快取輸入 $0.15;另有 contributor 版(輸入 $0.10/輸出 $0.20),代價是資料會用於改進產品,企業使用者需留意資料治理。既有推理模式即刻可用,max 推理模式待安全測試完成後才開放。值得注意的是,對照組競品是以 max 模式計分,而 1.3 的 max 推理尚未開放,對比條件是否對等仍待官方說明。
與 1.2 的落差:效率修正,開放權重仍無期
Muse Spark 1.2 於 8 月 5 日發表(含 Muse Code beta),1.3 相隔不到一個月,屬於效率與行為層面的修正版:工具呼叫與 token 減少直接壓低單次任務成本,「卡住會明說」則回應業界對 agent 亂跑、亂猜的批評。官方路線圖再次提到「更大模型」與「Muse Spark 開放權重釋出」,但仍沒有日期——1.2 的開放權重自 7 月 23 日承諾「soon」至今未兌現,Meta 目前真正釋出開放權重的只有 8 月 10 日的 Muse Glimmer(Apache 2.0)。Muse Spark 1.3 是封閉 API 模型,不應誤解為已開源。
對管理者的意義
同價格下工具呼叫少約 20%、token 少約 25%,切換到 1.3 後既有自動化流程的成本可望下降;「會問澄清問題」則意味交辦時給的背景資訊會被更主動確認。適合先在既有 Muse Code 或 API 工作流中切換模型,比對成本與完成率再決定是否遷移;等待開放權重自建部署的團隊,這次仍需繼續等。