Claude Mythos 5 安全扫描开放企业版公测
2026 年 8 月 21 日,Anthropic 宣布把原本仅限经审核安全防御者使用的 Claude Mythos 5,用于驱动 Claude Security 的漏洞扫描,向所有 Claude Enterprise 客户开放公测;同时设立 3,500 万美元 Defender Advantage Fund 资助开源软件安全,并扩大 Cyber Verification Program。
2026 年 8 月 21 日,Anthropic 发布《Bringing the cybersecurity capabilities of Claude Mythos 5 to more defenders》,宣布把原本严格管控的高安全能力模型 Claude Mythos 5,用于驱动 Claude Security(Anthropic 面向企业客户的安全功能,并不是另一个模型)的漏洞扫描,并自即日起向所有 Claude Enterprise 客户开放公测(public beta)。多家科技与安全媒体在同日跟进报道。
Claude Mythos 5 是 2026 年 6 月 9 日与 Claude Fable 5 双轨发布的模型;更早的 Mythos Preview 自 2026 年 4 月起,只限「经审核的安全防御者」获取。本次公告最关键的一句话是:企业客户不需要另外申请该模型的访问权限,只要在 Claude Security 里指定一个代码仓库,就能直接启动扫描。
扫描结果长什么样
按官方说明,扫描输出会按 CWE(Common Weakness Enumeration,常见缺陷列举)分类,每一项发现附带三种信息:
- 严重程度:该缺陷一旦被利用,影响有多大。
- 置信度:模型对「这确实是漏洞」的把握程度,让团队排优先级时不必把每条告警都当真。
- 修复建议:不只指出问题,直接给出可动手的修复方向。
对长年被误报淹没的安全团队来说,「置信度」这一栏比扫出多少条漏洞更有意义——它把工具从「生成工单的机器」拉回「帮忙排序的同事」。
管模型、不管产出的分层设计
Anthropic 的论述值得完整理解:当用户拿到的只是「特定产出」——某个漏洞的修复建议或一条安全告警——而不是模型本体的开放访问,滥用风险会大幅下降。攻击者无法拿这个入口去自由探测任意目标,只能得到自家指定仓库的检查结果。于是 Anthropic 可以在保留模型本身管控的前提下,把防御成果的可及面扩大。
这等于把「能力管控」与「成果普及」拆成两件事处理,直面安全 AI 长期的两难:模型越强,理论上越可能同时增强攻击方;但若因此完全封锁,受害的是资源本就不足的防御方。
3,500 万美元投向开源
同步宣布的 Defender Advantage Fund 规模 3,500 万美元,以 Claude 额度形式资助改善开源软件安全的组织,资助聚焦三个方向:
- 修复广泛使用项目中实际存在的漏洞,而非产出研究报告。
- 把扫描与修复自动化到其他项目可以复制。
- 帮助项目采取能抵御整类攻击的更根本安全做法。
三个方向的共同点是「可扩散」——资助的不是单点修复,而是修复的方法。Anthropic 同时宣布扩大 Cyber Verification Program(安全验证计划),也就是那道决定谁算「经审核防御者」的门,开得更大。
对管理者的意义
值得记住的不是又一个扫描工具,而是这套分层授权的思路:把高风险能力锁住、把低风险产出开放。企业内部推 AI 时常卡在「全开或全关」的二选一,这条新闻示范了第三条路——限制的是能力的可及面,而不是成果的受益面。如果贵公司正好是 Claude Enterprise 客户,这周可以做的一件小事,是挑一个最旧、最没人敢动的仓库丢进去扫一次,先看看清单长什么样。