ARC-AGI-2基准发布,人类100%解决,前沿AI低于5%
ARC-AGI-2:前沿AI推理系统的新挑战
我们的论文介绍了评估AI抽象推理能力的领先基准
- 人类解决100%的任务
- 前沿AI得分<5%
@fchollet
@mikeknoop
@GregKamradt
@bryanlanders
Henry Pinkard
我们的论文介绍了评估AI抽象推理能力的领先基准
- 人类解决100%的任务
- 前沿AI得分<5%
@fchollet
@mikeknoop
@GregKamradt
@bryanlanders
Henry Pinkard