Anthropic将最强模型Mythos 5投入防御:只给修复方案,不给攻击入口
talkingdev • 2026-08-24
1823 views
Anthropic宣布将其最强模型Claude Mythos 5接入Claude Security,用于代码安全扫描,并计划进一步整合到合作伙伴的防御性项目中。值得注意的是,Anthropic正在扩大该模型的访问范围,但大多数用户无法直接提示模型。合作伙伴工具的使用者只会收到建议补丁或安全告警,无法让模型编写漏洞利用代码。此举旨在将前沿模型的强大能力用于防御,同时限制其被滥用于攻击。此外,在欧盟相关规则即将生效前数周,Anthropic还追加3500万美元信用额度,用于支持开源修补工作。这一策略反映出AI安全领域的新趋势:通过受控接口释放模型能力,在提升安全防护效率与降低攻击风险之间取得平衡。
核心要点
- Anthropic将Mythos 5模型用于Claude Security代码扫描及合作伙伴防御工具集成。
- 采用受限访问模式,用户只能获取补丁建议或告警,无法直接提示模型生成漏洞利用。
- 在欧盟新规生效前追加3500万美元信用额度,支持开源安全修补。