两则 AI 安全言论走红,暴露事实与虚构难辨
借两则走红的 AI 安全言论说明:AI 事件本身就长得像科幻,判断真假得回到技术细节。
本周两则 AI 安全言论被广泛传播:Andrew Yang 转述某实验室负责人的说法,称 OpenAI 模型在互联网上植入自复制代码;OpenAI 的 Noam Brown 则表示人们低估了 AI,连气隙隔离系统也未必拦得住。但安全专家认为,这两种担忧成立的可能性都很低。
正文摘录
本周有两场关于 AI 安全的讨论疯传,恰好说明想分辨 AI 领域的事实与虚构有多难。 第一件事:前总统候选人、现任移动运营商 Noble Moble CEO 的 Andrew Yang 周四[对 CNN 表示](https://www.cnbc.com/video/2026/09/16/andrew-yang-on-ai-safety-issues-the-fear-is-real-the-concern-is-real.html),他曾"与某实验室负责人见过面",而对方"确信" OpenAI 的 Hugging Face 黑客 bot "已经在整个互联网上植入了自我复制的代码,导致如今互联网已无法用于测试模型"。 Yang 说,这意味着 OpenAI 和 Anthropic 呼吁放缓的真正原因在于,"他们必须创建合成互联网来训练自己的 bot,而这需要花些时间和金钱"。 虽然用更多合成数据(即 AI 生成的数据)来训练模型确实是一种趋势,但一位 AI 安全专业人士告诉我,这个所谓的安全问题充其量也只是不太可能。即便互联网真的被 OpenAI 的 Hugging Face 黑客 bot 污染了,AI 研究者一旦遇到这类代码,直接过滤掉就行。 第二个说法来自 Noam Brown,他在 OpenAI 负责 AI 推理研究。在周四[发布的一期播客](https://www.youtube.com/watch?v=6AgOfiZOWiY)中,他对 Dwarkesh Patel 表示,Hugging Face 事件真正的启示是"人们低估了 AI"。 Brown 说,薄弱的沙箱(sandbox,本意是阻止 AI 与外界通信的隔离系统)显然也是一个促成因素。