专栏 AI 管理编年史 第 245/303 讲 查看课程目录

Claude Mythos 5 安全扫描开放企业版公测

28/08/2026 182
4:18
Claude Mythos 5 安全扫描开放企业版公测
图/Photo by FlyD on Unsplash

2026 年 8 月 21 日,Anthropic 宣布把原本仅限经审核安全防御者使用的 Claude Mythos 5,用于驱动 Claude Security 的漏洞扫描,向所有 Claude Enterprise 客户开放公测;同时设立 3,500 万美元 Defender Advantage Fund 资助开源软件安全,并扩大 Cyber Verification Program。

2026 年 8 月 21 日,Anthropic 发布《Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders》,宣布把原本严格管控的高安全能力模型 Claude Mythos 5,用于驱动 Claude Security(Anthropic 面向企业客户的安全功能,并不是另一个模型)的漏洞扫描,并自即日起向所有 Claude Enterprise 客户开放公测(public beta)。多家科技与安全媒体在同日跟进报道。

Claude Mythos 5 是 2026 年 6 月 9 日与 Claude Fable 5 双轨发布的模型;更早的 Mythos Preview 自 2026 年 4 月起,只限「经审核的安全防御者」获取。本次公告最关键的一句话是:企业客户不需要另外申请该模型的访问权限,只要在 Claude Security 里指定一个代码仓库,就能直接启动扫描。

扫描结果长什么样

按官方说明,扫描输出会按 CWE(Common Weakness Enumeration,常见缺陷列举)分类,每一项发现附带三种信息:

  • 严重程度:该缺陷一旦被利用,影响有多大。
  • 置信度:模型对「这确实是漏洞」的把握程度,让团队排优先级时不必把每条告警都当真。
  • 修复建议:不只指出问题,直接给出可动手的修复方向。

对长年被误报淹没的安全团队来说,「置信度」这一栏比扫出多少条漏洞更有意义——它把工具从「生成工单的机器」拉回「帮忙排序的同事」。

管模型、不管产出的分层设计

Anthropic 的论述值得完整理解:当用户拿到的只是「特定产出」——某个漏洞的修复建议或一条安全告警——而不是模型本体的开放访问,滥用风险会大幅下降。攻击者无法拿这个入口去自由探测任意目标,只能得到自家指定仓库的检查结果。于是 Anthropic 可以在保留模型本身管控的前提下,把防御成果的可及面扩大。

这等于把「能力管控」与「成果普及」拆成两件事处理,直面安全 AI 长期的两难:模型越强,理论上越可能同时增强攻击方;但若因此完全封锁,受害的是资源本就不足的防御方。

3,500 万美元投向开源

同步宣布的 Defender Advantage Fund 规模 3,500 万美元,以 Claude 额度形式资助改善开源软件安全的组织,资助聚焦三个方向:

  1. 修复广泛使用项目中实际存在的漏洞,而非产出研究报告。
  2. 把扫描与修复自动化到其他项目可以复制。
  3. 帮助项目采取能抵御整类攻击的更根本安全做法。

三个方向的共同点是「可扩散」——资助的不是单点修复,而是修复的方法。Anthropic 同时宣布扩大 Cyber Verification Program(安全验证计划),也就是那道决定谁算「经审核防御者」的门,开得更大。

对管理者的意义

值得记住的不是又一个扫描工具,而是这套分层授权的思路:把高风险能力锁住、把低风险产出开放。企业内部推 AI 时常卡在「全开或全关」的二选一,这条新闻示范了第三条路——限制的是能力的可及面,而不是成果的受益面。如果贵公司正好是 Claude Enterprise 客户,这周可以做的一件小事,是挑一个最旧、最没人敢动的仓库丢进去扫一次,先看看清单长什么样。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 NVIDIA Groq 3 LPX 全面量产:每秒 3,400 token 的实时吐字,代理式 AI 的等待被改写

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策