专栏 AI 管理编年史 第 255/303 讲 查看课程目录

Anthropic 同日发布 Claude Fable 5.1 与 Mythos 5.1:缓存读取降价七成五,护栏转向「更精准」

01/09/2026 148
4:08
Anthropic 同日发布 Claude Fable 5.1 与 Mythos 5.1:缓存读取降价七成五,护栏转向「更精准」
图/Photo by Markus Winkler on Unsplash

Anthropic 于 2026 年 9 月 1 日同时发布 Claude Fable 5.1 与 Claude Mythos 5.1。两款均支持 100 万 token 上下文、单次输出上限 128,000 token,知识截止日推进到 2026 年 6 月。输入输出定价持平,但缓存读取由每百万 token 1.00 美元降到 0.25 美元;新增对话中途调整算力投入的 beta 功能,网络安全分类器误触发大幅减少。

2026 年 9 月 1 日,Anthropic 同日发布两款新模型:Claude Fable 5.1 与 Claude Mythos 5.1。前者通过 Claude API 广泛开放,开发者可直接调用;后者只开放给通过「Project Glasswing」审核的少数用户,且目前仅限美国境内的组织。同一天发布、同一个版本号,开放程度却天差地别——这本身就是此次发布最值得留意的信号。

规格与定价:账面没涨,长上下文实质降本

两款模型的基本规格一致:

  • 上下文长度 100 万 token
  • 单次输出上限 128,000 token
  • 知识截止日推进到 2026 年 6 月

定价与前代持平:输入每百万 token 10 美元、输出每百万 token 50 美元。真正变动的是缓存读取——由每百万 token 1.00 美元降到 0.25 美元,只剩原本的四分之一。这一刀砍在「反复读同一份长文档」的场景:把整份合同、整个代码库、整年度报表塞进上下文反复问答,成本结构被直接改写。性能方面,基准测试 Terminal-Bench-Science 0.1 上 Fable 5.1 得 52.6%,前代为 42.0%。

对话中途调整算力投入:从「选模型」到「换挡」

新增的 beta 功能「对话中途调整算力投入(mid-conversation effort adjustment)」,允许在同一段对话里临时把模型的思考力度调高或调低,不必为了换挡而重开新对话。过去是先选好模型与参数、一路用到底;现在则是同一场对话里按需换挡——整理资料时省着用,遇到关键判断再加大力度。对长流程自动化而言,成本控制的颗粒度从「一整段对话」细到「一个回合」。

安全护栏转向「更精准」而非「更宽松」

Anthropic 强调此次护栏调整的方向是减少误伤,而非放松:

  • 网络安全分类器误触发次数减少 60%——允许漏洞识别,仍拦截攻击代码生成
  • 生物领域分类器在一般医疗问题上的误触发减少 85%

此外新增符合欧盟 AI Act 的统计式水印,以及防蒸馏(anti-distillation)限制。Mythos 5.1 则走另一条路:为通过审核的网络安全防御者与生命科学研究者放宽部分分类器,并可用于 Claude Security for Enterprise 的代码库漏洞扫描与修补建议。同日 Anthropic 也预告面向私有云部署的 Enterprise Frontier Safeguards,稍后推出。

对管理者的意义

这则发布摊开两件事:一是 AI 的价格战已经不打「标价」,改打使用姿势——同样每百万 token 10 美元,把长文档放进缓存反复问,跟每次重贴一遍,成本差好几倍;二是能力释放开始按身份分级,同一代模型对普通开发者与对通过审核的组织,能做的事并不一样。正在评估导入的管理者,先问自己团队:我们是「一问一答」,还是「同一份资料反复问」?前者感受不到此次降价,后者值得重新算一笔账。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 Gemini 3.8 Flash 与 Flash Cyber 发布:三周内第三款 Flash,入门价撑到年底

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策