动态

Claude Fable 5发布,性能SOTA,质量飞跃,建议大胆使用但注意安全

Andrej Karpathy
这是一个非常令人兴奋的发布——Claude Fable 5 与 Mythos 底层模型相同,但增加了安全措施。基准测试结果很好,它在所有指标上都以一定优势达到了SOTA,但我还要补充一点,*定性*上这也是一个值得重大版本更新的进步(在我看来与11月的Claude 4.5同等级别),尤其在解决极难问题的长会话中表现突出。你可以给它比以往更雄心勃勃的任务,模型会“理解”并直接执行,感觉从未如此诱人以至于不再查看代码(但不要在生产中这样做!)。模型仍然有一些人们会遇到的小问题,安全措施在发布时设置得有点过于敏感,希望可以随着时间调整。

随着可用软件越来越多地像水龙头一样流出,我感到很多事情在改变。杰文斯悖论开始显现,我自己对软件的需求大幅增长。你可以要求任何东西——解释器、可视化工具、仪表盘、定制的一次性应用(例如一个仅针对你项目的高度特化的wandb),你可以将测试套件提升10倍,自动优化代码,运行带自定义HTML结果的大型研究项目,任何东西!“解放你的思想”(黑客帝国梗)。非常期待大家构建的一切!
Claude
Fable 5 在几乎所有测试基准上都达到了最先进水平,在软件工程、知识工作、科学研究和视觉方面表现尤为出色。

任务越长越复杂,Fable 5 相对于我们其他模型的领先优势就越大。
动态Andrej Karpathy2026-06-09原文

相关内容