Project Glasswing 是我们为确保全球最重要软件安全而开展的协作项目。四月初,我们宣布约有 50 家初始合作伙伴获得了 Claude Mythos Preview 的访问权限,此后,他们一直在部署该模型以扫描其代码库中的漏洞。我们近期介绍了这些合作伙伴迄今为止已发现超过 10,000 个高危或严重级别的安全缺陷。
我们现在正在扩大 Project Glasswing 的规模。在与 Project Glasswing 合作伙伴、安全行业、开源软件维护者以及美国政府进行了数周的紧密合作后,我们将合作伙伴关系扩展至约 150 家新组织。每家组织在获得访问权限前,都必须满足我们的安全要求。
这批新组织来自超过 15 个国家,其中大多数还为更多国家提供关键基础设施。(未来,我们计划进一步扩大地理覆盖范围。)该群体涵盖了初始合作群体中代表性不足的几个行业,例如电力、水务、医疗、通信和硬件。此外,许多新合作伙伴是供应商——即维护着全球众多其他组织(包括政府)所依赖的代码库的公司或非营利组织。
这些合作伙伴的共同点是,其代码库若遭受成功攻击,后果可能是灾难性的。我们估计,对大多数合作伙伴而言,一次重大攻击可能影响超过 1 亿人,并对全球和国家安全产生重大影响。
此次扩展是我们迈向长期目标的下一步:让 AI 使所有软件更加安全,并帮助我们行业适应 AI 可能如何改变网络安全的许多核心假设。
Project Glasswing 的角色
Project Glasswing 以及 Claude Mythos Preview 的能力,已在软件行业内部及与政府的对话中引发了广泛讨论,探讨 AI 如何改变网络安全。这些讨论为我们如何扩展该项目提供了信息,也塑造了我们对 Project Glasswing 根本目的的看法。
廉价、快速且具备强大网络能力的 AI 模型即将问世。我们希望“玻璃翼计划”能推动各机构建立适应这一现实的运营规范。
“幻象预览版”延续了我们一段时间以来一直警示的长期趋势:预计在未来 6 到 12 个月内,许多其他 AI 公司也将拥有“幻象”级别的模型,并且它们可能会在未设置防止滥用的安全措施的情况下发布这些模型。到那时,网络攻击可能发生得更加频繁,形式也更加难以预测。网络防御者必须适应这种变化,才能跟上节奏。
我们认为自身肩负双重角色。首先,通过安全地广泛提供更优质的模型、工具和通用基础设施,帮助软件行业适应新形势。其次,稳步转变我们提供的支持,从发现漏洞转向披露、修复和部署已修补的软件。下面我们将逐一讨论这两点。
支持网络防御者
迄今为止,企业、非营利组织、维护者和研究人员行动迅速。在“玻璃翼计划”启动的头几周内,每位成员就开始大规模使用“幻象预览版”,与其他合作伙伴共享信息和最佳实践,并与第三方合作对模型发现的结果进行分类处理。这些组织适应新工具的方法,能够且应该被广泛复制到数百万个易受网络攻击的组织和开发者中。
为支持这一点,我们最近发布了 Claude Security 产品,该产品使用我们最新的前沿公开模型(如 Claude Opus 4.8)来扫描代码库并提出补丁建议。同时,我们还应请求向受信任的安全团队发布了我们开发的工具,这些工具旨在帮助“玻璃翼计划”的合作伙伴更快地发现漏洞。
我们计划走得更远:我们的长期目标是支持行业为强大网络模型时代创建新的倡议、标准和基础设施。
加速补丁修复及其他安全工作
正如我们之前讨论过的,网络安全领域的瓶颈现在在于验证、披露和修补“幻象”级别模型所能发现的大量漏洞。
Mythos Preview 本身就能提供帮助。Project Glasswing 的许多合作伙伴现在使用该模型编写补丁,以及进行预发布检查,从而从一开始就防止漏洞出现。像 Mythos Preview 这样的模型还可用于渗透测试(模拟网络攻击以识别漏洞可能如何被利用)、自动化威胁检测与响应,以及用内存安全语言重建遗留代码库等众多防御性任务。
我们正在与第三方讨论如何大规模扩展对开源软件漏洞的审查和修补工作。同时,我们也在分享向开源维护者披露漏洞的思路和最佳实践,旨在让这些报告更易于分类和处理。
未来之路
为了应对这一即将到来的挑战的规模,数十万个组织、研究人员和维护者很可能需要获得最先进的网络能力和工具。
我们正以最快的速度努力安全地公开发布 Mythos 级别的能力。为此,我们需要极其强大的防护措施,以防止模型的网络能力被滥用——这些防护措施(据我们所知,所有其他 AI 开发者也是如此)我们尚未开发出来。由于网络安全既有有益用途也有破坏性用途,制造既强大又足够精确的防护措施是一项重大挑战。
与此同时,我们计划进一步扩展 Project Glasswing——优先考虑更多关键基础设施提供商、关键开源软件的维护者以及安全测试人员。我们打算像本次扩展一样,未来将覆盖美国及海外的组织。我们还计划扩大我们的网络验证计划,该计划将向更多组织授予 Mythos 级别的能力,用于特定的网络防御任务。
未来,前沿模型的发布将变得愈发事关重大。模型能力将在所有领域持续提升,包括许多像网络安全这样既能赋能攻击者也能赋能防御者的领域。这不会是我们最后一次需要应对这样的挑战。但“玻璃翼计划”让我们学到了很多,当模型跨越重要能力门槛时该如何应对。如果我们成功,我们希望为防御者带来持久的优势。