Anthropic Research 中文翻译

create: 2026-05-22
update: 2026-08-10
author: thinkycx
title: 【译】Project Glasswing 初步进展报告
description: Anthropic 及约 50 个合作伙伴使用 Claude Mythos Preview 发现了超过一万个高危或关键漏洞。开源项目扫描发现 23,019 个漏洞,其中预计 3,900 个为高危/关键。瓶颈已从发现漏洞转向验证、披露和修补。
category: translation
tags: anthropic, research, translation, safety

Project Glasswing 初步进展报告

发布日期:2026-05-22
分类:Announcements

Project Glasswing 初步进展报告


引言

上月 Anthropic 启动了 Project Glasswing,一项协作计划,旨在在日益强大的 AI 模型被武器化之前加固关键软件。

启动以来,Anthropic 及约 50 个合作伙伴已使用 Claude Mythos Preview 发现了超过一万个高危或关键级别的漏洞。瓶颈已从发现漏洞转移到验证、披露和修补由 AI 发现的大量问题上。

本文涵盖:Mythos Preview 性能的早期公开证据、扫描数千个开源项目的初步结果、对网络防御者的影响,以及 Project Glasswing 和 Mythos 级模型发布的未来计划。


早期成果

关于 Mythos Preview 发现的讨论方式

软件行业的标准做法是在发现后 90 天(或补丁发布后约 45 天)披露新漏洞。 Anthropic 自身的协调漏洞披露政策遵循这一做法。

由于已披露漏洞滞后于 AI 模型的实际网络能力,Anthropic 目前提供的是示例说明和汇总统计数据,而非合作伙伴发现的完整细节。

来自合作伙伴和外部测试者的证据

Project Glasswing 的初始合作伙伴构建和维护着互联网和关键基础设施运行所依赖的基础软件。 启动一个月后:

  • 大多数合作伙伴各自发现了数百个关键或高危漏洞
  • 总计发现超过一万个
  • 多家报告漏洞发现率提升了十倍以上

合作伙伴重要成果:

组织 发现成果
Cloudflare 共 2,000 个漏洞(400 个高危/关键级别);误报率优于人类测试者
英国 AI 安全研究所 首个端到端解决两个网络靶场(多步网络攻击模拟)的模型
Mozilla详细文章 在 Firefox 150 中发现并修复 271 个漏洞——比使用 Claude Opus 4.6 在 Firefox 148 中发现的多 10 倍以上
XBOW 在 Web 漏洞利用基准上"显著超越所有现有模型";token 换 token 基础上具有"绝对前所未有的精度"
ExploitBenchExploitGym Mythos Preview 在两个学术基准上均为最强表现者(详见前沿红队博客

行业补丁加速:

组织 变化
Palo Alto Networks 最新版本包含的补丁数量是平时的五倍以上
Microsoft 报告新补丁数量将"在一段时间内继续呈上升趋势"
Oracle 跨产品和云环境发现和修复漏洞的速度比以前快数倍

额外用例: 在一家 Glasswing 合作伙伴银行,Mythos Preview 在威胁行为者入侵了客户的电子邮件账户并进行欺骗性电话后,帮助检测并阻止了一笔 150 万美元的欺诈电汇。


开源软件

Anthropic 在过去几个月中使用 Mythos Preview 扫描了超过 1,000 个开源项目。

汇总统计

指标 数量
发现的漏洞总数(所有严重级别) 23,019
预估高危或关键级别 6,202
由独立安全公司评估 1,752(高危/关键中的)
确认为真阳性 1,587(90.6%)
确认为高危或关键级别 1,094(62.4%)
按当前真阳性率预估的高危/关键总数 约 3,900

披露流程

阶段 数量/状态
已向维护者披露的高危/关键漏洞 约 530
已确认但等待披露的漏洞 827
应维护者请求直接报告的未审核漏洞 1,129(预估 175 个高危/关键)
已部署补丁 75(530 个已披露高危/关键中的)
已发布公开公告 65
修补高危/关键漏洞的平均时间 约 2 周

wolfSSL 案例

一个重要发现是在 wolfSSL 中——一个被数十亿设备使用的开源密码学库。 Mythos Preview 构建了一个利用,允许攻击者伪造证书——使银行或电子邮件提供商的假冒网站看起来合法。这个现已修补的漏洞被分配了编号 CVE-2026-5194

披露仪表板

开源漏洞披露仪表板

仪表板显示所有严重级别的漏洞,并跟踪各披露阶段的进展。每个阶段都有陡峭的下降,反映了所需的人工努力。

分诊挑战

这一流程涉及复现问题、重新评估严重性、检查现有修复,以及向维护者撰写详细报告。 维护者面临大量低质量 AI 生成的漏洞报告,部分维护者已要求 Anthropic 放慢披露速度,因为他们需要更多时间来设计补丁。


适应网络安全的新阶段

具有与 Mythos Preview 类似能力的模型将很快更广泛可用。 当前从漏洞发现到补丁创建再到部署之间的滞后为攻击者留下了窗口。Mythos 级模型显著缩短了发现和利用漏洞所需的时间和成本,放大了这一风险。

对软件开发者的建议

建议 说明
缩短补丁周期 快速发布安全修复
使用公开可用的 AI 模型辅助 Anthropic 正在构建工具和分享研究成果
使更新易于安装 降低用户更新的摩擦
对运行已知漏洞软件的用户更加坚持 加强推送更新

对网络防御者的建议

建议 说明
缩短补丁测试和部署时间线
实施关键控制措施 来自 NIST 和英国国家网络安全中心
加固默认配置 强制多因素认证,维护全面日志

使用公开可用 AI 模型进行网络防御的工具

  • Claude Security(Claude 企业客户公开测试版):扫描代码库中的漏洞并生成修复建议。自上线三周以来,Claude Opus 4.7 已被用于修补超过 2,100 个漏洞
  • 网络验证计划:允许安全专业人员将模型用于合法网络安全目的,无需某些滥用预防保护措施。
  • 现可向合格客户提供的合作伙伴工具:
  • Skills(用于重复工作的自定义指令)
  • 用于代码库映射、扫描子代理、分诊和报告撰写的框架
  • 威胁模型构建器——映射代码库、识别攻击目标并确定工作优先级

Cisco 也已开源其 Foundry Security Spec,帮助其他防御者构建类似的评估系统。


支持生态系统


Project Glasswing 的下一步

AI 进步意味着与 Mythos Preview 同等能力的模型将很快被许多 AI 公司开发出来。 没有任何公司(包括 Anthropic)尚未开发出足够强大的保护措施来防止此类模型的滥用。这就是为什么 Mythos 级模型尚未公开发布,也是为什么启动了 Project Glasswing。

下一步计划:

方向 说明
扩大合作伙伴范围 与关键合作伙伴——包括美国及盟国政府——合作,将 Project Glasswing 扩展到更多合作伙伴
开发更强保护措施 为 Mythos 级模型最终的公开发布开发所需的远更强大的安全防护

Anthropic 表达了信心:

"在这些风险的另一端,有一个令人鼓舞的世界等待着我们——代码经过加固,黑客攻击远不如现在普遍。"


相关内容