Claude Fable 5登顶MirrorCode编程基准 跨语言解出率仅降3%
Claude Fable 5 在严格编程基准中夺冠,且跨语言表现稳定,说明前沿 AI 已具备从零构建完整软件项目的能力。
MirrorCode 是一项测试 AI 从零构建软件项目的基准,要求模型在隔离环境中通过黑盒观察重建程序,且必须通过全部测试。Claude Fable 5 以 64% 的成功率登顶,远超 GPT-5.6 Sol 的 24%。更关键的是,将语言从 Go 换成冷门语言 Ada 后,其成功率仅下降 3 个百分点,而其他模型降幅显著。这表明最强模型已不再依赖训练语料记忆,而是真正理解了程序逻辑,能够跨语言重构。
正文摘录
 新智元报道  Claude 这次,真把 AI 编程榜单打出了断层! 就在刚刚刷新的 MirrorCode 排行榜上,Claude Fable 5 以 64% 的绝对成功率再次登顶。 紧追其后的 GPT-5.6 Sol,分数只有它的三分之一! 排在第四的 GPT-5.5 更惨。不仅成绩只有 10%,甚至还被自家前辈 GPT-5.4 按在地上摩擦。  更让人意外的是,在使用 Go 等高资源语言时,Fable 5 的解出率是 64%;换成冷门语言 Ada,成绩仍然高达 61%。 要知道,在开源世界里,Python 语料大约是 Ada 的 230 倍。 但到了 Fable 5 这里,成绩居然只下降 3 个百分点。  这就有意思了。 如果模型主要靠记忆热门语言的语法和常见写法,那么换成 Ada 之后成绩应该出现下降才对。 而现在的结果,却指向另一种可能—— 最强模型已经摆脱了具体语料的牵引,开始学会如何从零构建一个完整的软件项目。