Project Glasswing 初步更新
发布日期: 2026-05-22
来源: https://www.anthropic.com/research/glasswing-initial-update
Project Glasswing 是 Anthropic 发起的网络安全协作项目,目标是在更强大的 AI 模型被用于攻击关键软件之前,先用它们帮助修复世界上最重要的软件系统。
项目进展
项目启动后,Anthropic 和大约 50 个合作伙伴使用 Claude Mythos Preview 在关键软件中发现了一万多个高危或严重漏洞。这些软件涉及互联网和基础设施中非常重要的组件。
文章强调,由于漏洞披露有固定周期,公开披露的数据往往滞后于模型真实能力。因此 Anthropic 只能分享部分初步观察,而不能立即公开所有细节。
Mythos Preview 的能力信号
文章提到,外部测试者和合作伙伴都观察到 Mythos Preview 在网络安全任务中表现强劲。例如:
- 英国 AI Security Institute 报告称,Mythos Preview 是第一个端到端完成其两个 cyber ranges 的模型;
- Mozilla 在测试中发现并修复了大量 Firefox 漏洞;
- 多个合作伙伴在各自代码库中发现数百个高危或严重漏洞。
这些结果说明,AI 在网络安全中的能力已经进入需要严肃治理和协作的阶段。
对企业 AI 安全的启示
这篇文章有两个方向的意义。
第一,AI 可以大幅提升防御能力。企业可以用更强的模型做漏洞发现、代码审计、安全测试和修复建议。
第二,同样的能力也可能被攻击者使用。因此,关键软件和企业基础设施需要更早进行防御准备。
对 Agent 产品的启示
当 Agent 能够读代码、运行测试、访问网络和调用工具时,它们的安全边界必须比普通 Chatbot 更严格。网络安全 Agent 尤其需要:
- sandbox;
- 权限控制;
- 漏洞披露流程;
- 人类专家复核;
- 审计日志;
- 任务隔离;
- 对输出的风险分级。
适合阅读的人
- 网络安全团队;
- 使用 Claude 做代码审计的工程师;
- 构建安全 Agent 的开发者;
- 企业 AI 风险治理负责人。