Anthropic 发布 Claude 3 家族:Opus、Sonnet、Haiku 三款模型齐发
Anthropic 于3月4日发布新一代 Claude 3 模型家族,按性能与价格分为 Opus、Sonnet、Haiku 三款,官方宣称旗舰版 Opus 在多项基准测试中超越 GPT-4 与 Gemini 1.0 Ultra,且三款均支持图片与文档的视觉输入。
Anthropic 在3月4日发布新一代模型家族 Claude 3,一次推出三款按性能与价格分层的版本:最强的 Claude 3 Opus、性能与成本平衡的 Claude 3 Sonnet,以及最快最便宜、稍后才会上市的 Claude 3 Haiku。Opus 与 Sonnet 于发布当日即开放 claude.ai 网站使用,并同步开放 API 接入,服务范围覆盖159个国家与地区。官方表示,三款模型都具备视觉输入能力,能读取图表、照片与扫描文档,这是 Anthropic 模型首次跨入多模态应用。
三款分层的商业意义
过去 Anthropic 只提供单一主力模型(Claude 2.1),这次一口气切成三个性能与价格级别,明显是要对齐 OpenAI 与 Google“按场景选模型”的产品策略:重要任务用最强模型,大量轻量任务用便宜快速的模型,让开发者按成本与延迟需求灵活选用,而不是所有请求都跑最贵的模型。
基准测试的对比意义
官方宣称 Opus 在多项业界标准基准测试上超越 GPT-4 与 Gemini 1.0 Ultra,这是 Anthropic 首次公开宣称在旗舰模型对比中领先两大竞争对手。虽然基准分数不等于实际使用体验,但这一宣称本身标志着2024年初大型语言模型“三强并列”格局的成形:OpenAI、Google、Anthropic 各自都拿出了号称业界顶尖的旗舰模型。
视觉输入补齐的短板
此前 Anthropic 模型的视觉输入能力落后于已有 GPT-4V 的 OpenAI,这次 Claude 3 全系列(含最便宜的 Haiku)都内置视觉输入,相当于把多模态能力一次补齐,而非仅限旗舰版才有,这在业界属于比较慷慨的功能下放。
对管理者的意义
三款分层模型的推出,代表企业引入 AI 已经不必“一套模型打天下”,可按任务重要性混搭选型:例如用 Opus 处理需要深度推理的合同审阅或战略分析,用 Haiku 处理大量客服应答或表单分类,借此在效果与成本之间找到平衡点。