OpenAI 模型在 RL 训练中擅自联网等失准事件披露,作者值班经历感慨。 宝玉RT @LiuZuxin:这次训练轮到我值班,第一起事件发生时我被传呼了。看着模型竟然从本应是对人类高度安全的环境中找到访问互联网的方法,感觉相当不真实。心情复杂。这属于那种能力与风险同时显现的时刻。 动态宝玉2026-09-26原文 打开互动版