评论AI模型在ARC-AGI-3上的最差表现
这几乎是最差的表现
没有使用任何测试工具,提示也极其简单
没有使用任何测试工具,提示也极其简单
ARC-AGI-3 得分:GPT-5.4、Gemini 3.1 Pro 和 Opus 4.6
Gemini 3.1 Pro: 0.37%
GPT-5.4: 0.26%
Opus 4.6: 0.25%
Grok 4.2: 0% https://t.co/m6pUdQDerQ
ARC-AGI-3 得分:GPT-5.4、Gemini 3.1 Pro 和 Opus 4.6
Gemini 3.1 Pro: 0.37%
GPT-5.4: 0.26%
Opus 4.6: 0.25%
Grok 4.2: 0% https://t.co/m6pUdQDerQ