行业新闻

Claude Fable 5登顶MirrorCode编程基准 跨语言解出率仅降3%

Claude Fable 5 在严格编程基准中夺冠,且跨语言表现稳定,说明前沿 AI 已具备从零构建完整软件项目的能力。

MirrorCode 是一项测试 AI 从零构建软件项目的基准,要求模型在隔离环境中通过黑盒观察重建程序,且必须通过全部测试。Claude Fable 5 以 64% 的成功率登顶,远超 GPT-5.6 Sol 的 24%。更关键的是,将语言从 Go 换成冷门语言 Ada 后,其成功率仅下降 3 个百分点,而其他模型降幅显著。这表明最强模型已不再依赖训练语料记忆,而是真正理解了程序逻辑,能够跨语言重构。

正文摘录

![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimgc467f01174.webp) 新智元报道 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg3b253ef414-38.png) Claude 这次,真把 AI 编程榜单打出了断层! 就在刚刚刷新的 MirrorCode 排行榜上,Claude Fable 5 以 64% 的绝对成功率再次登顶。 紧追其后的 GPT-5.6 Sol,分数只有它的三分之一! 排在第四的 GPT-5.5 更惨。不仅成绩只有 10%,甚至还被自家前辈 GPT-5.4 按在地上摩擦。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimgc5953ef0b7.webp) 更让人意外的是,在使用 Go 等高资源语言时,Fable 5 的解出率是 64%;换成冷门语言 Ada,成绩仍然高达 61%。 要知道,在开源世界里,Python 语料大约是 Ada 的 230 倍。 但到了 Fable 5 这里,成绩居然只下降 3 个百分点。 ![](https://aiera.com.cn/wp-content/uploads/2026/08/aieraimg8599cccc01.webp) 这就有意思了。 如果模型主要靠记忆热门语言的语法和常见写法,那么换成 Ada 之后成绩应该出现下降才对。 而现在的结果,却指向另一种可能—— 最强模型已经摆脱了具体语料的牵引,开始学会如何从零构建一个完整的软件项目。

阅读原文(aiera.com.cn)→

行业新闻新智元2026-08-05原文

相关内容