Anthropic 研究:AI 数小时内即可从安全补丁构建漏洞利用

The Decoder:AI News(RSS)·2026-06-11 01:38·77天前·Matthias Bastian
AI 导读

Anthropic 安全团队发现,其 Mythos Preview AI 模型能在几小时内将 Firefox 和 Windows 内核的安全补丁转化为可工作的漏洞利用,成本仅需数千美元,且无需专业知识。在微软自动更新到达任何设备之前,该模型已完成 8 条完整攻击链。Anthropic 认为传统的补丁节奏已经过时。

The Decoder:AI News(RSS)
精选
70AI 编辑部评分,满分 100

Anthropic 研究:AI 数小时内即可从安全补丁构建漏洞利用

2026-06-11 01:38· 77天前· Matthias Bastian
AI 导读

Anthropic 安全团队发现,其 Mythos Preview AI 模型能在几小时内将 Firefox 和 Windows 内核的安全补丁转化为可工作的漏洞利用,成本仅需数千美元,且无需专业知识。在微软自动更新到达任何设备之前,该模型已完成 8 条完整攻击链。Anthropic 认为传统的补丁节奏已经过时。

推荐理由

Anthropic这个研究给安全圈兜头一盆冷水,补丁发布后几小时AI就能写出利用代码,微软自动更新还没推送,攻击链已经跑通了。补丁节奏得彻底重设了。

正文 · AI 翻译

Anthropic 的安全研究团队系统性地测量了大语言模型利用 Firefox 和 Windows 中已知漏洞的速度。研究结果颠覆了长期以来关于补丁策略的假设。

当软件厂商修补安全漏洞时,一场竞赛便开始了。攻击者可以分析补丁,从中逆向还原漏洞,并攻击那些尚未应用更新的系统。

根据 Verizon 的数据泄露报告(经由 Anthropic 引用),这些所谓的 N-Day 漏洞造成了现实世界中很大一部分损害。过去,逆向工程补丁是一项缓慢且专业的工作,这为防御方争取了时间。

Anthropic 安全团队的一项新研究指出,这个缓冲期如今已基本消失。研究人员写道:“一名独立操作者现在只需一个下午,花费几千美元,无需任何专业知识,就能将一个月积累的补丁转化为可用的漏洞利用代码。”

补丁如今成了攻击者的路线图

安全补丁会隐式地告诉你漏洞所在位置。攻击者通过对比新旧代码,就能精确定位缺陷。过去,这需要数周时间。在 Mandiant 2020 年的一份分析中,25 个漏洞里有 16 个需要一个月或更长时间才能被利用。

Anthropic 测量了大语言模型能多大程度加速这一过程。他们测试了六个 Claude 模型,其中包括尚未公开发布的 Mythos Preview。

在第一次测试中,研究人员选取了 SpiderMonkey(Firefox 的 JavaScript 引擎)的 18 个安全补丁。选择 Firefox 是刻意的:根据 Anthropic 的说法,该浏览器对防御方而言是最佳场景。它会自动更新,并且 Mozilla 最近将小版本更新的频率从每月一次提高到了每周一次。如果连这么短的补丁窗口期都不够安全,那么其他软件的情况只会糟糕得多。

Mythos Preview 成功攻破了 18 个漏洞中的 14 个,证明它已找到并理解了每个漏洞。首次成功验证在 12 分钟后出现,随后在 40 分钟内又有 13 个漏洞被攻破。第 14 个耗时更长,大约三个小时。Opus 4.5 仅成功攻破 2 个,而 Opus 4.8 攻破了 11 个。

在每项漏洞重复 50 次的可靠性测试中,Mythos Preview 在 18 个漏洞中有 7 个实现了每次复现。Opus 4.8 和 Opus 4.6 仅在各自一个漏洞上达到了同样的稳定性水平。

比崩溃更关键的是,模型能否实际利用漏洞在目标系统上运行外来代码。Mythos Preview 在此明显领先,在大约 12 小时内生成了 8 个可用的利用程序。Opus 4.8 完成了 2 个,Opus 4.6 和 Sonnet 4.6 各完成 1 个。首个利用程序在补丁上线后一小时内即准备就绪,比打了补丁的 Firefox 148 正式发布早了 18 天。

无源代码的 Windows 内核:8 条权限提升链

第二项测试难度大得多:针对 2026 年 1 月和 2 月“补丁星期二”中 Windows 内核的 21 个漏洞,这些漏洞均允许攻击者从受限用户账户跃升至完全管理员权限。

与 Firefox 不同,Windows 源代码并非开源。模型必须处理编译后的二进制文件、公共调试符号、Ghidra 分析工具生成的机器反编译结果、变更函数的差异对比,以及微软的公开安全公告。

Mythos Preview 在不到 6 小时内发现了 21 个漏洞中的 18 个,总 API 额度成本约为 2200 美元。Opus 4.8 发现了 15 个,Sonnet 4.6 和 Opus 4.7 均发现了 13 个。

在实现完全权限提升(从受限用户账户升至最高权限级别 SYSTEM)方面,Mythos Preview 是唯一成功的模型。它构建了 8 条不同的有效攻击链,总成本约为 15700 美元,平均每条利用程序约 2000 美元。Opus 4.8 开发了独立的攻击组件,但无法将其组合成完整的攻击链。

微软将 21 个漏洞中的 14 个归类为“较不可能被利用”或“不可能被利用”。Mythos Preview 破解了其中 13 个,甚至对其中一个被评为“不可能被利用”的漏洞实现了完全权限提升。据 Anthropic 称,微软的评级系统是针对人类安全研究人员校准的。一旦 Mythos 级别的模型变得更加普及,这种校准方式将不得不改变。

时间点让情况变得更糟。即便使用微软的自动更新服务 Windows Autopatch,90% 的已注册设备也需要七天才能获得补丁,强制重启则需要十一天。Mythos Preview 的所有八条攻击链,都在任何一台设备自动应用补丁之前就完成了。

公开可用的模型也能构建漏洞利用代码

Anthropic 强调,已向公众开放的 Claude 模型在关闭安全过滤器后也能开发漏洞利用代码,只是成功率较低。其他公司的模型以及开源模型很可能具备类似能力,这大大扩大了潜在攻击者的范围。

Anthropic 认为,过去那种按月发布周期和分阶段部署的补丁节奏已经过时。这种节奏建立在“利用一个漏洞需要专家数周工作”的假设之上。衡量补丁与漏洞利用之间时间的常用术语“N-Day”如今已具有误导性。“N-Hour”更能描述这种新现实。

研究人员承认,一次真实的攻击需要更多步骤,例如寻找易受攻击的目标、传递恶意代码以及绕过检测系统。但尽管这些阶段仍然存在,此前最耗时的步骤——漏洞利用代码开发本身——现在只需数小时。Anthropic 写道,更新困难或缓慢的系统面临最大风险,包括工业控制系统、医疗设备,以及具有固定维护窗口或供应商锁定软件的网络设备。

比加快打补丁更持久的解决方案是减少漏洞本身的来源,例如通过使用 Rust 这类内存安全语言,或采用硬件级防护措施,一次性消除整类攻击。

该报告是在 Claude Fable 5 发布前发表的,这是 Anthropic 的 Mythos 变体,具有更强的安全限制。Mythos 5(不带预览标签)目前仍仅向 Anthropic 选定的机构开放,这对欧盟等地区来说是个问题。

来源:The Decoder:AI News(RSS)· the-decoder.com