OpenAI发布检测AI模型欺骗行为的研究 OpenAI今天,我们与@apolloaievals发布了一项研究。在受控测试中,我们在前沿模型中发现了与欺骗一致的行为,并测试了减少这种行为的方案。虽然我们认为这些行为目前不会造成严重危害,但这是我们在准备的未来风险。 动态OpenAI2025-09-17原文 打开互动版