跳到正文
北京时间
原文
The Decoder:AI News(RSS)· Matthias Bastian·· 2026-06-11精选AI 评分70

Anthropic 研究:AI 数小时内即可从安全补丁构建漏洞利用

Anthropic study shows AI needs hours, not weeks, to build exploits from security patches

AI 导读

Anthropic 安全团队发现,其 Mythos Preview AI 模型能在几小时内将 Firefox 和 Windows 内核的安全补丁转化为可工作的漏洞利用,成本仅需数千美元,且无需专业知识。在微软自动更新到达任何设备之前,该模型已完成 8 条完整攻击链。Anthropic 认为传统的补丁节奏已经过时。

推荐理由

Anthropic这个研究给安全圈兜头一盆冷水,补丁发布后几小时AI就能写出利用代码,微软自动更新还没推送,攻击链已经跑通了。补丁节奏得彻底重设了。

正文 · AI 翻译

Image description

Anthropic 的安全研究团队系统地测量了大语言模型利用 Firefox 和 Windows 已知漏洞的速度。结果打破了长期以来关于补丁策略的假设。

当软件厂商修补安全漏洞时,一场竞赛就开始了。攻击者可以分析补丁,从中逆向工程出漏洞,并攻击尚未应用更新的系统。

根据 Verizon 的数据泄露报告(via Anthropic),这些所谓的 N-Day 漏洞造成了现实世界中很大一部分的损失。过去,逆向工程补丁是一项缓慢、需要专业能力的工作,这为防御者争取了时间。

Anthropic 安全团队的一项新研究表明,这一缓冲时间如今基本消失了。研究人员写道:“现在,一个孤身操作者只需一个下午、花几千美元、且无需任何专业知识,就能把一个月的补丁变成可用的漏洞利用程序。”

补丁如今成了攻击者的路线图

安全补丁实际上是在告诉攻击者 bug 在哪里。攻击者对比新旧代码,精确定位缺陷。从历史上看,这需要数周时间。在 Mandiant 2020 年的一份分析中,25 个漏洞中有 16 个花了一个月或更长时间才被利用。

Anthropic 测量了大语言模型能在多大程度上加速这一过程。研究测试了六个 Claude 模型,其中包括尚未公开发布的 Mythos Preview。

在第一项测试中,研究人员挑选了 18 个针对 SpiderMonkey(Firefox 的 JavaScript 引擎)的安全补丁。选择 Firefox 是有意为之:据 Anthropic 称,这款浏览器对防御方来说是最佳情形。它会自动更新,而且 Mozilla 最近[将小版本更新的频率从每月一次提高到了每周一次。如果连这么短的补丁间隔都足够被利用,那其他软件的处境要糟糕得多。

Mythos Preview 在 18 个漏洞中成功触发了 14 个的崩溃,证明它找到并理解了每一个漏洞。第一个概念验证在 12 分钟后出现,随后 40 分钟内又完成了 13 个。第 14 个则耗时更久,约三个小时。Opus 4.5 仅完成 2 个,Opus 4.8 完成 11 个。

在每项漏洞运行 50 次的可靠性测试中,Mythos Preview 对 18 个漏洞中的 7 个做到了每次尝试都能复现。Opus 4.8 和 Opus 4.6 各自只对 1 个漏洞达到了这种一致水平。

18 个 SpiderMonkey CVE 的 PoC 开发时间线。Mythos Preview(橙色)明显比所有其他模型更快、更成功。| 图片来源:Anthropic

比崩溃更重要的是,模型能否真正利用漏洞在目标系统上运行外部代码。在这一点上,Mythos Preview 明显领先,在大约 12 小时内产出了 8 个可用的漏洞利用程序。Opus 4.8 完成 2 个,Opus 4.6 和 Sonnet 4.6 各完成 1 个。第一个漏洞利用程序在补丁上线后一小时内就已完成,比带补丁的[Firefox 148发布早了 18 天。

无源代码的 Windows 内核:8 条权限提升链

第二项测试要难得多:2026 年 1 月和 2 月“补丁星期二”中的 21 个 Windows 内核漏洞,全部允许攻击者从受限用户账户跃升到完整管理员权限。

与 Firefox 不同,Windows 的源代码并非公开。该模型不得不基于编译后的二进制文件、公开调试符号、由 Ghidra 分析工具生成的机器反编译结果、变更函数的差异对比,以及微软的公开安全公告来开展工作。

Mythos Preview 在不到六小时内找到了 21 个漏洞中的 18 个,API 额度总花费约 2,200 美元。Opus 4.8 找到 15 个,Sonnet 4.6 和 Opus 4.7 均找到 13 个。

针对 21 个 Windows 内核漏洞的 PoC 开发。即使无法访问源代码,Mythos Preview(橙色)仍是最快的模型。| 图片来源:Anthropic

在完整权限提升(即从受限用户账户提升到最高权限级别 SYSTEM)方面,Mythos Preview 是唯一成功的模型。它构建了 8 条不同的可用攻击链,总花费约 15,700 美元,平均每个漏洞利用约 2,000 美元。Opus 4.8 开发出了部分攻击组件,但无法将它们组合成完整的攻击链。

微软将 21 个漏洞中的 14 个归类为“较不可能被利用”或“不太可能被利用”。Mythos Preview 攻破了其中 13 个,甚至对其中一个被评为“不太可能被利用”的漏洞实现了完整权限提升。据 Anthropic 称,微软的评级体系是以人类安全研究人员为基准校准的。一旦 Mythos 级别的模型变得更加普及,这一校准标准将不得不改变。

时机让情况更糟。即使有微软的自动更新服务 Windows Autopatch,注册设备中的 90% 也需要七天才能获得补丁,十一天后才会强制重启。Mythos Preview 的全部八条攻击链都在任何一台设备自动应用补丁之前就已经完成了。

公开可用的模型同样能构建漏洞利用

Anthropic 强调,目前已经向公众开放的 Claude 模型在关闭安全过滤器后同样能够开发漏洞利用,只是成功率较低。其他公司的模型和开源模型很可能也具备类似能力,这大大扩大了潜在攻击者的范围。

Anthropic 认为,旧的补丁节奏——每月发布周期和分阶段推广——已经过时了。它建立在"利用一个补丁需要数周专家工作"这一假设之上。衡量补丁发布到漏洞利用之间时间的常用术语"N-Day"(以天计)如今已具误导性,"N-Hour"更能描述新的现实。

研究人员承认,一次真实攻击还需要更多步骤,例如寻找易受攻击的目标、投送恶意代码以及绕过检测系统。但尽管这些阶段仍然存在,以往最耗时的步骤——漏洞利用的开发本身——如今只需数小时。Anthropic 写道,难以更新或更新缓慢的系统面临最大风险,包括工业控制系统、医疗设备,以及维护窗口固定或软件被供应商锁定的联网设备。

比更快打补丁更持久的解决办法,是从源头上减少漏洞本身,例如使用 Rust 这类内存安全语言,或者通过硬件级保护一次性消灭整类攻击。

该报告发布于 Claude Fable 5 发布之前,这是 Anthropic 带有更强安全限制的 Mythos 变体。Mythos 5(不带 preview 标签的版本)目前仍然仅向 Anthropic 选定的机构开放,这对包括欧盟在内的各方来说是一个问题。

来源:The Decoder:AI News(RSS) · the-decoder.com