專欄 AI 管理編年史 第 89/217 講 查看課程目錄

Anthropic 發表 Claude 3.7 Sonnet 與 Claude Code:首個「混合推理」模型登場

24/02/2025 106
4:47
Anthropic 發表 Claude 3.7 Sonnet 與 Claude Code:首個「混合推理」模型登場

Anthropic 於 2025 年 2 月 24 日發表 Claude 3.7 Sonnet,號稱旗下最聰明的模型,也是市場首個「混合推理」模型,使用者可自由切換即時回應與逐步深度推理。同步推出代理式命令列工具 Claude Code,讓開發者能把大型工程任務直接交給 AI 在終端機執行。

2025 年 2 月 24 日,Anthropic 正式發表 Claude 3.7 Sonnet,官方稱這是公司旗下「最聰明」的模型,同時也是市場上第一個「混合推理」(hybrid reasoning)模型。所謂混合推理,是指同一顆模型內建兩種運作模式:使用者可以選擇讓模型產生近乎即時的一般回應,也可以主動切換到「延伸思考」模式,讓模型逐步展示完整的推理過程再給出答案。這與過去把「快速模型」和「推理模型」拆成兩個獨立產品線的做法不同,Anthropic 把兩者收進同一個模型裡,由使用者依任務難度自行決定要不要「多想一下」。

Claude 3.7 Sonnet 這次特別加強的是程式撰寫與前端網頁開發能力,官方表示在實際工程任務上有明顯進步。新模型即日起開放於所有 Claude 方案(包含免費版)、Claude 開發者平台,以及 Amazon Bedrock 與 Google Cloud Vertex AI 三大雲端管道;不過完整的延伸推理功能,目前僅限付費方案用戶使用,免費用戶只能使用一般回應模式。

與模型同步發表的,還有一款全新的命令列工具「Claude Code」。這是一款代理式(agentic)程式開發工具,讓開發者可以直接在終端機裡,把撰寫功能、除錯、重構等大型工程任務整段交給 Claude 自主執行,而不只是逐行對話式地要程式碼片段。目前 Claude Code 以「有限研究預覽」(limited research preview)形式開放,尚未大規模開放申請。

技術意義:從「聊天式輔助」走向「可控深度推理+自主執行」

混合推理架構的意義在於,它把「回應速度」與「回應品質」的取捨權交還給使用者,而不是由廠商預先幫你決定用哪一顆模型。同時,Claude Code 的發表也標誌 Anthropic 把重心從「模型本身聰不聰明」延伸到「模型能不能被放進真實工作流程、自主完成一整段任務」,這是「代理式 AI」(agentic AI)路線的具體落地,而非停留在單輪問答。

與前代及市場定位的比較

相較於 Anthropic 先前的 Claude 3.5 系列,3.7 Sonnet 的重點不是全面換代,而是在「同一顆模型」內新增可切換的深度推理層,加上針對程式撰寫場景的顯著優化。這樣的定位也讓 Claude 3.7 Sonnet 在當時與其他業者陸續推出的獨立推理模型(如需要另外挑選模型才能啟用逐步推理的做法)形成差異——Anthropic 選擇的是「一個模型、兩種模式」,簡化了使用者的選擇成本,也讓推理能力更容易被整合進既有的開發流程與雲端服務(Bedrock、Vertex AI)。

業界反應與開放策略

值得注意的是,Anthropic 這次把基礎版本的 Claude 3.7 Sonnet 開放給免費用戶使用,只把「完整延伸推理」保留給付費方案,這種分層開放策略讓更多開發者能第一時間接觸新模型,同時保留付費誘因。而 Claude Code 採取限量研究預覽而非全面公開,顯示 Anthropic 對「讓 AI 自主操作終端機、直接修改程式碼庫」這件事仍相當謹慎,選擇先在受控範圍內蒐集回饋,再決定後續開放節奏。

對管理者的意義

對管理者而言,這則新聞的重點不是「又一顆更強的模型」,而是「AI 開始能被交付一整段任務、而非只回答單一問題」。如果團隊有工程或技術部門,值得留意 Claude Code 這類代理式工具未來申請開放時,是否適合先小範圍試點,觀察它在真實專案裡能承擔多少工程量、又需要多少人力覆核,藉此提前評估導入代理式 AI 對團隊分工與生產力的實際影響。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 OpenAI 發表 GPT-4.5 研究預覽版:不靠推理鏈,靠「知識與情商」取勝

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策