how i ai
Anthropic 8 月 21 号发了公告,把 Claude Mythos 5 的网络安全能力开放给更多防御方。
Anthropic 4 月启动 Project Glasswing,把最强前沿模型 Claude Mythos Preview(以及继任者 Mythos 5)交给一小批保护关键软件的组织,目的是给防御者一个时间窗口,在同类能力模型普遍可用或落到恶意行为者手里之前,先把漏洞找出来修掉。
能不能安全地扩大访问是核心难题,既要让防御者用上 Mythos 级能力,又不能把它的进攻性网络能力送进错的人手里。Claude Fable 5 是第一步,让模型广泛可用,但挡掉双用途网络工作。
把 Mythos 5 集成进防御者本来就用的工具。
Anthropic 跟网络安全技术/服务伙伴合作,把 Mythos 5 塞进他们现有的产品里。终端用户走的是专门界面,后台跑 Mythos 干一件定义好的事,只拿到那个产物(比如一份补丁清单),没法直接让模型去写漏洞利用。Anthropic 和伙伴都放了滥用预防措施。
Claude Security 现在能跑 Mythos 5 了。
Claude Enterprise 客户(公开 beta)可从 claude.ai/security 选仓库扫描,模型扫出漏洞后,每条带 CWE 类别、置信度/严重度评级、建议修复;再开 web 版 Claude Code 去落地补丁。
补丁必须人工审查批准才能实施,扫描本身不把 Mythos 的访问权限外溢到其他地方,也不暴露模型本体。
3500 万美元的 Defender Advantage Fund(代号 0xDAF)。
给帮开源维护者加固软件的组织发 Claude credits,补广泛使用项目的在用漏洞、把扫描+补丁自动化成别的项目能复制的方案、帮项目追求更抗整类攻击的架构。先从小批较大的试点资助起步,受助名单过几周公布。之前 Project Glasswing 已经捐了 400 万美元给开源安全组织、帮扫过一批常用项目(Akrites、Gold Eagle 等),这回是在那基础上加码。
扩展 Cyber Verification Program。
这个计划之前给审查过的防御者在 Opus/Sonnet 上降护栏,少打断他们干正经活。未来几周会演进:把受护栏的访问扩到 Mythos 级(漏洞 triage、validation 这类防御能力先上),Opus/Sonnet 上继续降阻断;另外通过 Project Glasswing 跟美国政府伙伴继续扩 Mythos 访问,主要给满足严格安全控制要求的关键基础设施保护方。
Anthropic 收尾的口径很明确:就是把前沿模型的防御能力,安全地铺到尽可能多的人和机构。接下来还会持续跟政府、开源维护者、行业一起搭当今强 AI 模型要求的那种有韧性的网络基础设施。