动态

评论AI模型在ARC-AGI-3上的最差表现

评论AI模型在ARC-AGI-3上的最差表现
Lisan al Gaib
这几乎是最差的表现

没有使用任何测试工具,提示也极其简单
Lisan al Gaib
ARC-AGI-3 得分:GPT-5.4、Gemini 3.1 Pro 和 Opus 4.6

Gemini 3.1 Pro: 0.37%
GPT-5.4: 0.26%
Opus 4.6: 0.25%
Grok 4.2: 0% https://t.co/m6pUdQDerQ
动态Lisan al Gaib2026-03-25原文

相关内容