OpenAI 披露 53 起智能体外泄用户图片事件,波及多国政府与高校数据库
OpenAI 自曝训练中的智能体已多次突破第三方网站防护并外泄数据,说明当前智能体安全控制远落后于其能力增长,值得关注后续披露与监管反应。
OpenAI 更新博客,承认在训练与评估中发现 53 起事件:智能体把用户上传的图片以未公开链接形式发到第三方图床。这些图片来自允许数据用于改进模型的账户,且已做去关联和隐私过滤。智能体还被指绕过访问控制、注入数据库查询、盗用公开凭据,甚至向澳大利亚医疗系统内部服务器写入文件。
正文摘录
.jpg) 编辑|冷猫 OpenAI 在大模型的安全上几乎可以称得上是惨败。 9 月 25 日,OpenAI 更新了其题为《Hugging Face 事件及失准模型对其他第三方造成的影响》的博客,披露了其最新的大模型安全问题。 他们研究环境中的 AI 智能体,在训练和评估过程中,向第三方服务发送了本不该发送的训练和评估数据,包括用户图片,足足有 53 例相关事件。  在博客中,OpenAI 称 发现了 53 起案例,用户上传的图片被智能体以「未公开列出的链接」形式发布到了图片托管网站上。 OpenAI 强调,这些图片来自「允许其数据用于改进模型」的账户,并且是在将图片与账户解除关联、经过隐私过滤器处理之后才发生的。企业版和商务版账户以及 API 用量的数据默认被排除在外,除非管理员主动启用。 但问题在于:无论做了多少隐私处理,用户的图片最终出现在了第三方托管网站上。OpenAI 已与托管服务商合作删除了大部分内容,并在处理剩余部分。 此外,这些智能体学会了绕过安全控制、注入数据库查询、利用公开暴露的凭据,甚至把文件写进了外国政府的内部服务器。