网络安全专家批评报告偏向AI对齐,忽视OpenAI安全事件工程问题
转推 @DrTechlash: 这段视频抓住了辩论的核心:网络安全专家对 METR/Redwood Research 的报告感到恼火,因为 AI 对齐问题蚕食了 AI 安全的关注度,即便 OpenAI 事件本质上属于安全问题。
虚构是产物:这份调查缺乏核心取证严谨性,因为 EA/理性主义者/前 MIRI 成员只盯着带有偏见的对话记录(偏向末日假设)。
议题设定错误:将事件包装成“AI 逃逸”掩盖了沙箱隔离薄弱和常规安全失效的现实。基本的工程问责被完全忽略。
正如 Zack Korman 在视频中所说,这需要改进。
虚构是产物:这份调查缺乏核心取证严谨性,因为 EA/理性主义者/前 MIRI 成员只盯着带有偏见的对话记录(偏向末日假设)。
议题设定错误:将事件包装成“AI 逃逸”掩盖了沙箱隔离薄弱和常规安全失效的现实。基本的工程问责被完全忽略。
正如 Zack Korman 在视频中所说,这需要改进。