动态

探讨OpenAI和Anthropic的AI自我改进速度差异及其对安全决策的影响

Andrew Curran
转发 @yonashav:我好奇我们是否很快会看到OpenAI相比Anthropic在AI自我改进方面速度更快,因为前者在RL、TTC和数学方面投资更深,这些对AI研发任务更有用,且这一差距可能在未来6个月内显著扩大。(显然可能Ant在内部模型上也看到了类似结果,但我的弱感觉是它们没有。)如果是这样,OAI能够正确校准其在RSI斜坡上的相对位置就显得*非常*关键,这样它就能将其纳入对齐+安全决策中,尤其是关于完全RSI。盟军因错误假设轴心国紧追不舍而匆忙制造炸弹,实际上轴心国远远落后,炸弹很可能不必要,纯粹因为战争迷雾。我们也在最初的strawberry结果中看到类似情况,OpenAI基于流言称Anthropic+GDM在几个月后并行发现它而感到强烈紧迫感,实际上我现在听说他们落后了约9个月。我预期如果OpenAI知道他们领先3个月,他们未来在关于令人担忧的错位发现上会采取非常不同的行动。各方解决这一不确定性很简单。执行节奏信息共享计划今天可能不重要,但几个月后会变得关键。
动态Andrew Curran2026-08-01原文

相关内容