Anthropic 發表 Claude 3 家族:Opus、Sonnet、Haiku 三款模型齊發
Anthropic 於3月4日發表新一代 Claude 3 模型家族,依效能與價格分為 Opus、Sonnet、Haiku 三款,官方宣稱旗艦版 Opus 在多項基準測試超越 GPT-4 與 Gemini 1.0 Ultra,且三款皆支援圖片與文件的視覺輸入。
Anthropic 在3月4日發表新一代模型家族 Claude 3,一次推出三款依效能與價格分層的版本:最強的 Claude 3 Opus、效能與成本平衡的 Claude 3 Sonnet,以及最快最便宜、稍後才會上市的 Claude 3 Haiku。Opus 與 Sonnet 於發表當日即開放 claude.ai 網站使用,並同步開放 API 存取,服務範圍涵蓋159個國家與地區。官方表示,三款模型都具備視覺輸入能力,能讀取圖表、照片與掃描文件,這是 Anthropic 模型首次跨入多模態應用。
三款分層的商業意義
過去 Anthropic 只提供單一主力模型(Claude 2.1),這次一口氣切成三個效能與價格級距,明顯是要對齊 OpenAI 與 Google「依場景選模型」的產品策略:重任務用最強模型、大量輕量任務用便宜快速的模型,讓開發者依成本與延遲需求彈性選用,而不是所有請求都跑最貴的模型。
基準測試的對比意義
官方宣稱 Opus 在多項業界標準基準測試上超越 GPT-4 與 Gemini 1.0 Ultra,這是 Anthropic 首次公開宣稱在旗艦模型對比中領先兩大競爭對手。雖然基準分數不等於實際使用體驗,但這則宣稱本身標誌著 2024年初大型語言模型「三強並列」格局的成形:OpenAI、Google、Anthropic 各自都拿出了聲稱業界頂尖的旗艦模型。
視覺輸入補齊的短板
此前 Anthropic 模型的視覺輸入能力落後於已有 GPT-4V 的 OpenAI,這次 Claude 3 全系列(含最便宜的 Haiku)都內建視覺輸入,等於是把多模態能力一次補齊,而非僅限旗艦版才有,這在業界屬於較為慷慨的功能下放。
對管理者的意義
三款分層模型的推出,代表企業導入 AI 已經不必「一套模型打天下」,可依任務重要性混搭選型:例如用 Opus 處理需要深度推理的合約審閱或策略分析,用 Haiku 處理大量客服應答或表單分類,藉此在效果與成本之間找到平衡點。