OpenAI 模型证明 10 道数学难题 Anthropic 公开模型复现 5 道
OpenAI 未发布模型攻克 10 道数学难题,Anthropic 公开模型 24 小时复现 5 道,凸显 AI 数学成果的验证难题。
OpenAI 未发布的模型 Astra 一口气证明了 10 项前沿数学难题,成本不到 2000 美元。不到 24 小时,Anthropic 的公开模型 Fable 在无网络、防泄漏条件下独立复现了其中 5 项。这不仅是刷榜,更像一次同行评审:AI 能快速批量产出证明,但能否被读懂、核对,正成为更稀缺的能力。
正文摘录
 新智元报道  10项数学难题,24小时反转。 这个周末,OpenAI与Anthropic两大AI巨头,在数学的最前沿短兵相接。 先是8月1日,OpenAI研究员Sébastien Bubeck宣布,他们未公开的下一代主力模型Astra,一口气证明了10项前沿数学成果,还甩出了10份Lean证书、10份逐题思路复盘。  别小看这10个问题。 它们的主要结论至少10年没人推动过,不少一搁就是几十年,是货真价实的开放难题。  虽算不上数学里最深的未解之谜,却个个都是难啃的硬骨头。 Epoch AI旗下FrontierMath的负责人Elliot Glazer直言:光是非索菲克群这一篇,就肯定能进数学界公认的顶级期刊Annals of Mathematics。 这10道难题一甩出,AI圈直接炸了,有人当场喊出「数学奇点已经到来」。 Anthropic这边迅速接招。 不到24小时,研究员Levent Alpöge在Bubeck的帖子下回了一句:「我用Fable完成了一半。