发布ARC-AGI-2论文,分析设计原则与性能差距
我们刚刚发布了关于ARC-AGI-2的论文——涵盖其设计原则、更具挑战性的原因、人类表现的详细分析以及当前模型的表现。
ARC-AGI-2:前沿AI推理系统的新挑战
我们的论文介绍了评估AI抽象推理能力的主要基准
- 人类解决100%的任务
- 前沿AI得分<5%
@fchollet @mikeknoop @GregKamradt @bryanlanders Henry Pinkard https://t.co/U3xq3EJMLe
ARC-AGI-2:前沿AI推理系统的新挑战
我们的论文介绍了评估AI抽象推理能力的主要基准
- 人类解决100%的任务
- 前沿AI得分<5%
@fchollet @mikeknoop @GregKamradt @bryanlanders Henry Pinkard https://t.co/U3xq3EJMLe