动态

GPT-5.5在ARC AGI 3得分0.43%,分析失败原因。

GPT-5.5在ARC AGI 3得分0.43%,分析失败原因。
Chris
GPT-5.5 在 ARC AGI 3 上得分 0.43%!

- GPT-5.5: 0.43%
- Opus 4.7: 0.18%
- GPT-5.4: 0.20%
- Claude 4.6: 0.45%
- Gemini 3.1: 0.4%

报道的 GPT 5.5 失败原因包括:

- 真实的局部效果,错误的世界模型
- 从训练数据中提取的抽象层次错误
- 解决了该层次,但没有强化奖励

我认为完整的分析将帮助 OpenAI 全面了解模型在特定模态下失败的原因。
动态Chris2026-05-01原文

相关内容