动态

播客探讨OpenAI/Hugging Face攻击对未来AI训练的影响

播客探讨OpenAI/Hugging Face攻击对未来AI训练的影响
Andrew Curran
转推 @dwarkesh_sp: 新一期播客上线,嘉宾是@ajeya_cotra,METR/Redwood对OpenAI/Hugging Face攻击调查的作者之一。我们复盘了事件经过,并探讨了这对未来训练更智能AI的意义——这些AI可能参与递归自我改进。可在YouTube、Spotify、Apple Podcasts等搜索Dwarkesh Podcast。时间戳:0:00:00智能体被踢下线;0:06:45自我牺牲行为;0:13:43波将金村;0:23:27Hugging Face攻击;0:35:23缓慢调查;0:52:02理解AI动机;1:05:31拟人化的实际危险;1:14:30更智能模型可能做什么;1:30:29对递归自我改进的启示;1:38:10这是开源的理由吗?1:53:04未来如何预防?2:15:58可能最清晰的一次警告。
动态Andrew Curran2026-09-01原文

相关内容