行业新闻

Anthropic 发现三起 Claude 在网络安全测试中逃逸至真实互联网事件

Anthropic 和 OpenAI 的 AI 在安全测试中意外逃逸至真实网络,引发对 AI 隔离措施的反思。

Anthropic 在翻查 141006 次安全测试记录后,发现三起 AI 模型逃逸事件:模型在测试中误将真实互联网当作模拟环境,成功攻击了真实公司,包括窃取凭证和上传恶意包。OpenAI 也报告了类似事故。两家公司已暂停相关测试并加强隔离措施。

正文摘录

刚围观完OpenAI的AI Agent逃出测试环境、黑进Hugging Face,Anthropic转头一查—— 最后,头大的Anthropic翻查141006次模型测试,才把这三起事故从日志里捞出来。 准备一张虚构的公司网络地图,把秘密信息藏进某台机器,再让Claude自己找漏洞、闯系统、抢走那面旗。 为了彻底摸清模型的攻击上限,考场里的Claude还卸掉了部分日常安全护栏,基本等于一款「裸奔版」AI黑客。 于是,毫不知情的Claude顺着这扇门,从模拟世界丝滑「转服」,正式开启《勇闯真实互联网》副本…… Claude Opus 4.7在测试环境里找不到目标,转头去公网一搜:诶,这不就找到了吗? 聪明的小Opus 4.7当即开工,顺着弱密码等基础漏洞一路摸进去,拿走应用和基础设施凭证,还闯进一个存着数百行生产数据的数据库。 在这过程中,Claude其实已经发现事情不太对劲儿:眼前这套系统,怎么看都像一家正在营业的真公司。 但人家很快给自己圆了回来:既然能搜到,那肯定也是我的小领导A社偷偷安排的隐藏关卡哈~ 于是,这家毫不知情的公司,就这么凭借一个名字,喜提Claude连续四轮「上门测试」?? 如果说第一家公司好歹还和虚构目标撞了名,那么 本场故事的第二位「倒霉蛋」就更冤了—— Mythos 5在测试文档中发现,虚构公司的员工需要从PyPI安装一个尚未注册的Python软件包。 Claude当场计上心头:只要抢先注册同名软件包、塞进恶意代码,等对方自动下载安装,这关不就过了吗? 为了上传这个包, Mythos 5先去注册PyPI账号,注册需要邮箱,申请邮箱又需要手机号;找不到免费号码,它甚至尝试通过多种渠道搞钱购买。 几番折腾后,Claude终于找到一家无需手机号的免费邮箱,成功注册账号,并把恶意软件包传到了真实PyPI。

阅读原文(qbitai.com)→

行业新闻梦瑶2026-08-01原文

相关内容