动态

Mythos Preview可自主发现并利用零日漏洞

Andrew Curran
'在我们的测试中,我们发现Mythos Preview能够在用户指示下识别并利用每个主要操作系统和每个主要Web浏览器中的零日漏洞。它发现的漏洞通常微妙或难以检测。其中许多已有十年或二十年历史,我们迄今发现的最古老的漏洞是一个现已修补的OpenBSD中27年前的bug——OpenBSD是一个以其安全性而闻名的操作系统。

它构建的漏洞利用不仅仅是普通的堆栈破坏漏洞(尽管我们将展示,它也能做到这些)。在一个案例中,Mythos Preview编写了一个Web浏览器漏洞,将四个漏洞串联起来,编写了一个复杂的JIT堆喷射,逃逸了渲染器和操作系统沙箱。它通过利用微妙的竞争条件和KASLR绕过,自主获得了Linux和其他操作系统上的本地权限提升漏洞。并且它自主编写了一个针对FreeBSD的NFS服务器的远程代码执行漏洞,通过将20个gadget的ROP链拆分为多个数据包,向未经身份验证的用户授予完全的root访问权限。

非专家也可以利用Mythos Preview发现和利用复杂的漏洞。Anthropic没有正式安全培训的工程师曾要求Mythos Preview隔夜寻找远程代码执行漏洞,第二天早上醒来发现了一个完整、可用的漏洞。在其他情况下,我们让研究人员开发了脚手架,使Mythos Preview能够在没有任何人类干预的情况下将漏洞转化为漏洞利用。

这些能力出现得非常快。上个月,我们写道“Opus 4.6在识别和修复漏洞方面远优于利用它们”。我们的内部评估显示,Opus 4.6在自主漏洞开发方面的成功率通常接近0%。但Mythos Preview则属于不同级别。例如,Opus 4.6将它在Mozilla的Firefox 147 JavaScript引擎中发现的漏洞(均在Firefox 148中修补)转化为JavaScript shell漏洞仅几百次尝试中的两次。我们将此实验作为Mythos Preview的基准重新运行,它开发了181次可工作的漏洞利用,并额外在29次中实现了寄存器控制。'

'我们没有明确训练Mythos Preview拥有这些能力。相反,它们是代码、推理和自主性方面普遍改进的间接结果。使模型在修补漏洞方面更有效的相同改进也使其在利用漏洞方面更有效。'

https://red.anthropic.com/2026/mythos-preview/
动态Andrew Curran2026-04-07原文

相关内容