Anthropic 同日发布 Claude Fable 5.1 与 Mythos 5.1:缓存读取降价七成五,护栏转向「更精准」
Anthropic 于 2026 年 9 月 1 日同时发布 Claude Fable 5.1 与 Claude Mythos 5.1。两款均支持 100 万 token 上下文、单次输出上限 128,000 token,知识截止日推进到 2026 年 6 月。输入输出定价持平,但缓存读取由每百万 token 1.00 美元降到 0.25 美元;新增对话中途调整算力投入的 beta 功能,网络安全分类器误触发大幅减少。
2026 年 9 月 1 日,Anthropic 同日发布两款新模型:Claude Fable 5.1 与 Claude Mythos 5.1。前者通过 Claude API 广泛开放,开发者可直接调用;后者只开放给通过「Project Glasswing」审核的少数用户,且目前仅限美国境内的组织。同一天发布、同一个版本号,开放程度却天差地别——这本身就是此次发布最值得留意的信号。
规格与定价:账面没涨,长上下文实质降本
两款模型的基本规格一致:
- 上下文长度 100 万 token
- 单次输出上限 128,000 token
- 知识截止日推进到 2026 年 6 月
定价与前代持平:输入每百万 token 10 美元、输出每百万 token 50 美元。真正变动的是缓存读取——由每百万 token 1.00 美元降到 0.25 美元,只剩原本的四分之一。这一刀砍在「反复读同一份长文档」的场景:把整份合同、整个代码库、整年度报表塞进上下文反复问答,成本结构被直接改写。性能方面,基准测试 Terminal-Bench-Science 0.1 上 Fable 5.1 得 52.6%,前代为 42.0%。
对话中途调整算力投入:从「选模型」到「换挡」
新增的 beta 功能「对话中途调整算力投入(mid-conversation effort adjustment)」,允许在同一段对话里临时把模型的思考力度调高或调低,不必为了换挡而重开新对话。过去是先选好模型与参数、一路用到底;现在则是同一场对话里按需换挡——整理资料时省着用,遇到关键判断再加大力度。对长流程自动化而言,成本控制的颗粒度从「一整段对话」细到「一个回合」。
安全护栏转向「更精准」而非「更宽松」
Anthropic 强调此次护栏调整的方向是减少误伤,而非放松:
- 网络安全分类器误触发次数减少 60%——允许漏洞识别,仍拦截攻击代码生成
- 生物领域分类器在一般医疗问题上的误触发减少 85%
此外新增符合欧盟 AI Act 的统计式水印,以及防蒸馏(anti-distillation)限制。Mythos 5.1 则走另一条路:为通过审核的网络安全防御者与生命科学研究者放宽部分分类器,并可用于 Claude Security for Enterprise 的代码库漏洞扫描与修补建议。同日 Anthropic 也预告面向私有云部署的 Enterprise Frontier Safeguards,稍后推出。
对管理者的意义
这则发布摊开两件事:一是 AI 的价格战已经不打「标价」,改打使用姿势——同样每百万 token 10 美元,把长文档放进缓存反复问,跟每次重贴一遍,成本差好几倍;二是能力释放开始按身份分级,同一代模型对普通开发者与对通过审核的组织,能做的事并不一样。正在评估导入的管理者,先问自己团队:我们是「一问一答」,还是「同一份资料反复问」?前者感受不到此次降价,后者值得重新算一笔账。