GPT-5.5在ARC AGI 3得分0.43%,分析失败原因。
GPT-5.5 在 ARC AGI 3 上得分 0.43%!
- GPT-5.5: 0.43%
- Opus 4.7: 0.18%
- GPT-5.4: 0.20%
- Claude 4.6: 0.45%
- Gemini 3.1: 0.4%
报道的 GPT 5.5 失败原因包括:
- 真实的局部效果,错误的世界模型
- 从训练数据中提取的抽象层次错误
- 解决了该层次,但没有强化奖励
我认为完整的分析将帮助 OpenAI 全面了解模型在特定模态下失败的原因。
- GPT-5.5: 0.43%
- Opus 4.7: 0.18%
- GPT-5.4: 0.20%
- Claude 4.6: 0.45%
- Gemini 3.1: 0.4%
报道的 GPT 5.5 失败原因包括:
- 真实的局部效果,错误的世界模型
- 从训练数据中提取的抽象层次错误
- 解决了该层次,但没有强化奖励
我认为完整的分析将帮助 OpenAI 全面了解模型在特定模态下失败的原因。