动态

OpenAI与Anthropic合作进行安全对齐评估

Wojciech Zaremba
竞争对手合作是罕见的。然而,这正是OpenAI和@AnthropicAI刚刚做到的——通过各自内部的安全和对齐评估来测试对方的模型。今天,我们公布了结果。前沿AI公司必然会在能力上竞争。但与Anthropic的这项工作是一个小而有益的试点,旨在实现安全方面的“向上竞争”。竞争对手合作的事实比结果本身更有意义,结果大多是基本的。透明度+问责制→更安全的AI。阅读报告:https://t.co/eWLZY4gryC
动态Wojciech Zaremba2025-08-27原文

相关内容