Project Glasswing 首月发现超 10,000 个高危漏洞,修复平均耗时两周
核心事实
2026 年 5 月 22 日,Anthropic 发布 Project Glasswing 首月进展报告。约 50 家合作伙伴使用未公开发布的 Claude Mythos Preview 模型,合计发现超过 10,000 个高危或严重级别漏洞。Anthropic 独立扫描超过 1,000 个开源项目,识别出 23,019 个潜在漏洞,其中约 6,202 个为高危/严重级别。经六家独立安全机构评估,对 1,752 个已审核漏洞的确认率达 90.6%。同一天,Anthropic 还发布了面向企业的 Claude Security 公共测试版,用于代码库安全扫描。但报告同时指出:从漏洞发现到补丁完成,平均耗时两周,修复速度远落后于发现速度。
发生了什么
以下所有数据来自 Anthropic 官方博客发布的 Project Glasswing 初步进展报告及多家独立安全媒体的核实报道。
项目结构:Project Glasswing 是 Anthropic 于 2026 年 4 月启动的主动防御计划,核心工具是 Claude Mythos Preview——一个 Anthropic 因"防护措施仍不充分"而未公开发布的高能力安全模型。合作伙伴包括 Amazon Web Services、Apple、Broadcom、Cisco、CrowdStrike、Google、JPMorganChase、Linux 基金会、Microsoft、NVIDIA、Palo Alto Networks 等约 50 家机构。Anthropic 为此提供了高达 1 亿美元的 Mythos Preview 使用额度及 400 万美元的开源安全组织直接捐赠。
合作伙伴一个月的发现量:
- Cloudflare:一个月内发现 2,000 个 bug,其中 400 个为高危或严重级别,误报率"比人工测试员更低"。
- Mozilla:扫描 Firefox 150 发现 271 个漏洞,约是使用早期 Claude 模型扫描前一版本所得结果的 10 倍。
- Palo Alto Networks:发现了数十个自身代码中的漏洞。
- wolfSSL 案例:Mythos Preview 成功构造了一条针对 wolfSSL 加密库的利用链,攻击者可通过该漏洞伪造 TLS 证书,冒充银行或邮箱服务商。该漏洞已修复,技术细节暂未公开。
开源生态扫描:
- 扫描项目数:超过 1,000 个
- 潜在漏洞总数:23,019 个
- 高危/严重漏洞估计:6,202 个
- 已审核漏洞:1,752 个 → 确认率 90.6%(其中 62.4% 为高危/严重)
- 已报告给厂商的未审核发现:1,100+ 个
- 已修复的高危/严重漏洞:75 个
- 已发布的安全公告:65 份
修复是真正的瓶颈:从漏洞发现到补丁完成,平均耗时两周。在此期间,漏洞信息必须在泄露给攻击者之前得到控制——包括验证真伪、协调披露、开发补丁、测试、部署整个流程。Anthropic 坦承,即使按目前"相对缓慢的披露节奏",Mythos Preview 也已经"在给一个本就超负荷运转的安全生态增加压力"。
修复速度慢的三个原因已被指出:第一,多数漏洞仍处于 90 天协调披露窗口早期;第二,部分漏洞修复未发布公开公告,导致计数偏低;第三,也是核心问题——开源维护者群体的修复能力跟不上 AI 的发现速度。为此,Anthropic 与 OpenSSF 的 Alpha-Omega 项目合作,帮助开源维护者处理和分类漏洞报告。
Claude Security 公开测试版:扫描代码库查找漏洞并验证发现,提供针对性修复建议。与传统基于模式匹配的扫描器不同,Claude Security 通过追踪数据流和理解业务逻辑来推理代码,可识别传统工具漏掉的复杂问题。
公开发布的限制仍在:Anthropic 表示 Mythos Preview 尚未对外发布,原因是"目前还没有任何公司(包括 Anthropic)开发出足够强的防护措施来防止此类模型被滥用并造成严重危害"。但报告同时指出,类似能力级别的模型"很快将通过其他途径普遍可用"。公司正在与美国政府及盟国政府合作,计划在建立更强的防护措施后,让 Mythos 级模型公开可用。
为什么值得关注
Project Glasswing 揭示的不是"AI 能找漏洞"——这件事在 2026 年已不新鲜。它揭示的是发现速度和修复速度之间的落差,已经大到足以成为一个系统性风险。
量级级的速度差。Mozilla 同样的扫描对象,换一个更强的模型(从早期 Claude 到 Mythos Preview),发现量呈 10 倍增长。按这个轨迹,模型能力每进一步,发现速度还会加快。但修复链条——人工验证、协调、开发、测试、部署——的速度改进是线性的,不会自动跟上。
安全不对称的窗口在扩大。两周的平均修复周期意味着:每个被 AI 发现的高危漏洞,系统有两周时间暴露在风险中。如果攻击者也拿到类似能力的模型,他们可以在补丁发布前完成利用。Anthropic 用的是"防护措施不够充分"来解释为什么不公开 Mythos,但同时承认类似能力即将通过其他途径可用——这意味着防御窗口是有限的。
发现量本身不是成就。超过 10,000 个高危漏洞不是 Mythos 创造出来的问题,是已经存在于生产系统中、等着被发现的问题。Glasswing 只是让它们提前被发现了。这验证了一个更底层的判断:软件供应链中潜藏的安全债务远大于此前估计。
参考资料
- Project Glasswing: An initial update — Anthropic
- Anthropic: Claude Mythos identified 10,000+ software flaws — Help Net Security
- Anthropic: Mythos Detected 23,000 Potential Vulnerabilities Across 1,000 OSS Projects — SecurityWeek
- What Corporate Boards Need to Know and Do About Anthropic's Mythos and Project Glasswing — Harvard Law School Forum on Corporate Governance