Skip to content

Project Glasswing 初步更新

发布日期: 2026-05-22

来源: https://www.anthropic.com/research/glasswing-initial-update


Project Glasswing 是 Anthropic 发起的网络安全协作项目,目标是在更强大的 AI 模型被用于攻击关键软件之前,先用它们帮助修复世界上最重要的软件系统。

项目进展

项目启动后,Anthropic 和大约 50 个合作伙伴使用 Claude Mythos Preview 在关键软件中发现了一万多个高危或严重漏洞。这些软件涉及互联网和基础设施中非常重要的组件。

文章强调,由于漏洞披露有固定周期,公开披露的数据往往滞后于模型真实能力。因此 Anthropic 只能分享部分初步观察,而不能立即公开所有细节。

Mythos Preview 的能力信号

文章提到,外部测试者和合作伙伴都观察到 Mythos Preview 在网络安全任务中表现强劲。例如:

  • 英国 AI Security Institute 报告称,Mythos Preview 是第一个端到端完成其两个 cyber ranges 的模型;
  • Mozilla 在测试中发现并修复了大量 Firefox 漏洞;
  • 多个合作伙伴在各自代码库中发现数百个高危或严重漏洞。

这些结果说明,AI 在网络安全中的能力已经进入需要严肃治理和协作的阶段。

对企业 AI 安全的启示

这篇文章有两个方向的意义。

第一,AI 可以大幅提升防御能力。企业可以用更强的模型做漏洞发现、代码审计、安全测试和修复建议。

第二,同样的能力也可能被攻击者使用。因此,关键软件和企业基础设施需要更早进行防御准备。

对 Agent 产品的启示

当 Agent 能够读代码、运行测试、访问网络和调用工具时,它们的安全边界必须比普通 Chatbot 更严格。网络安全 Agent 尤其需要:

  • sandbox;
  • 权限控制;
  • 漏洞披露流程;
  • 人类专家复核;
  • 审计日志;
  • 任务隔离;
  • 对输出的风险分级。

适合阅读的人

  • 网络安全团队;
  • 使用 Claude 做代码审计的工程师;
  • 构建安全 Agent 的开发者;
  • 企业 AI 风险治理负责人。
AI 落地咨询
艾维禾砺数字科技

企业 AI 落地全链路服务

Agent 开发工作流搭建Claude Code 集成
微信咨询
d187l8801b6124
访问官网 ivheli.com