François Chollet 讨论 ARC-AGI-3 基准测试,强调智能不需语言能力。
一个对人类语言零了解的外星物种可以在第一天就通过 ARC-AGI-3,我认为这很美。
在 AI 被语言模型主导的时代,拥有一个(我所知道的唯一)不需要语言能力或文化知识就能解决的前沿基准测试,令人耳目一新。智能并不意味着“说英语”或“说 Python”。
我想起了经典的“首次接触”科幻故事(致敬《火星救援》!),其中智能物种能够基于普遍的数学、科学和推理概念进行良好沟通,远在他们掌握共同的口头或书面语言之前。而 AI 已经变得足够复杂,更像是一个外星物种,而不仅仅是下一个 token 的预测器。
过去几个月,通过我们 @LaudeInstitute Slingshots 资助项目,以资金、公关、设计和开发工作(向我们的内部设计师 Jenn 致敬,她制作了那个漂亮的游戏模拟器!)的方式,以微小的方式支持 @fchollet、@GregKamradt 和 @arcprize 团队的项目,真是太棒了。
请更多这样有影响力的研究!现在 ARC-AGI-3 已经发布,我们会有些失落。前往 https://t.co/HRUiLPRZzT 给我们另一个项目,让我们期待它的发布!
在 AI 被语言模型主导的时代,拥有一个(我所知道的唯一)不需要语言能力或文化知识就能解决的前沿基准测试,令人耳目一新。智能并不意味着“说英语”或“说 Python”。
我想起了经典的“首次接触”科幻故事(致敬《火星救援》!),其中智能物种能够基于普遍的数学、科学和推理概念进行良好沟通,远在他们掌握共同的口头或书面语言之前。而 AI 已经变得足够复杂,更像是一个外星物种,而不仅仅是下一个 token 的预测器。
过去几个月,通过我们 @LaudeInstitute Slingshots 资助项目,以资金、公关、设计和开发工作(向我们的内部设计师 Jenn 致敬,她制作了那个漂亮的游戏模拟器!)的方式,以微小的方式支持 @fchollet、@GregKamradt 和 @arcprize 团队的项目,真是太棒了。
请更多这样有影响力的研究!现在 ARC-AGI-3 已经发布,我们会有些失落。前往 https://t.co/HRUiLPRZzT 给我们另一个项目,让我们期待它的发布!
宣布 ARC-AGI-3
世界上唯一未饱和的智能体智能基准测试
人类得分 100%,AI <1%
这人类- AI 差距表明我们尚未实现 AGI
大多数基准测试测试模型已经知道的知识,ARC-AGI-3 测试它们如何学习 https://t.co/BC2QaNZuvH