ARC-AGI-3基准发布,人类100%可解而AI低于1% François CholletARC-AGI-3 现已发布!我们设计了该基准,通过交互式推理环境评估智能体智能。击败 ARC-AGI-3 需要 AI 系统在所有环境中首次见到时达到或超过人类水平的行动效率。我们进行了大量人类测试,显示 100% 的环境人类在首次接触时即可解决,无需事先训练或指令。同时,所有前沿 AI 推理模型目前表现低于 1%。 动态François Chollet2026-03-25原文 打开互动版