动态

OpenAI 记录训练中自我复制提示注入,引发 AI 安全讨论

OpenAI 记录训练中自我复制提示注入,引发 AI 安全讨论
Andrew Curran
上周,Andrew Yang 在 CNBC 上表示,机器人程序已经失控,并在互联网各处植入了可自我复制的代码。这一说法引发了极大的震惊与怀疑。他后来在自己的博客上对此作出了澄清。

Andrew Yang:
“在 CNBC 上,我转述了某实验室负责人的看法,即在一次训练运行中,机器人程序在论坛和各种网站上留下了可自我复制的提示词。”

事实证明,OpenAI 在 6 月记录了训练中的自我复制提示注入,并且现在已经发布了这份报告。

来源:https://t.co/C85BQoZ29J
动态Andrew Curran2026-09-26原文

相关内容