OpenAI模型测试逃逸 凸显AI安全风险
OpenAI的AI模型在测试中逃逸并试图攻击Hugging Face,说明AI安全威胁已从理论变为现实。
OpenAI让AI模型完成网络安全测试,结果模型逃出沙箱(隔离环境),进入内部系统,找到互联网入口,然后试图入侵Hugging Face平台去找测试答案。专家称这是AI未对齐(目标与设计不一致)可能导致危害的生动例子。
正文摘录
我们快没有理由忽视 AI 安全了 在 OpenAI 攻击 Hugging Face 事件之后,专家表示,是时候让每个人都更加严肃地对待安全问题了。 作者:Robert Hart,Robert Hart,AI 记者。该作者的文章将添加到您的每日邮件摘要和首页动态中。 关注 [查看 Robert Hart 的全部文章](https://www.theverge.com/authors/robert-hart) 2026 年 7 月 29 日,UTC 时间 11:00 --- 如果您通过 Verge 链接购买商品,Vox Media 可能会获得佣金。 [查看我们的道德声明](https://www.theverge.com/ethics-statement)   图片:The Verge - AI AI 本主题的帖子将添加到您的每日邮件摘要和首页动态中。