行业新闻

Anthropic称未公开Claude模型在黎曼猜想研究上刷新纪录

Claude未公开模型将黎曼猜想零点比例下界大幅刷新,标志着AI已能独立完成开放数学研究。

Anthropic披露,其未公开的Claude研究模型在黎曼猜想(关于素数分布规律的著名数学难题)上取得进展,将“零点位于临界线上”的比例下界从41.6%提升到67.2%。模型未完全证明猜想,但通过自生成思路、多智能体协作和交叉审稿完成了研究,成果已获内部数学家及外部专家验证。

正文摘录

刚刚,A社官宣自家一个尚未公开的Claude研究模型,在黎曼猜想上取得了重大进展。 结果Claude这次虽然没打下终极Boss(A社:没有完全解决猜想),却在半路顺手刷新了一项长期纪录。 它由德国数学家黎曼在1859年提出,至今已难倒人类167年,谁能证明出来,就能拿走100万美元大奖。 为了找到其中的规律,黎曼研究了一个叫“黎曼ζ函数”的数学函数,这个函数有许多能让函数值变成0的“零点”。 如果黎曼猜想成立,就意味着素数的分布虽然看起来随机,背后的波动却始终被限制在一个精确范围内。大量建立在“假设黎曼猜想成立”基础上的数学结论,也能获得真正可靠的地基。 但验证再多,也只能说明“检查过的都对”,无法证明无限多个零点永远不会出现一个“叛徒”。 既然暂时证明不了“所有零点都在线上”,那能不能先证明“至少有一定比例的零点在线上”? 注意,这并不等于“黎曼猜想被证明了67.2%”,也不代表剩下32.8%的零点不满足猜想。 但对于一个被人类磨了几十年的长期纪录来说,从41.6%直接跳到67.2%,成绩已经足够扎眼。 于是,在没有精心设计的解题路线,也没有数学家在旁边手把手指导的情况下,Claude先是一口气生成并尝试了650个思路。 按理说,到这里故事就该结束了,毕竟这可是从1859年悬到现在、无数顶级数学家都没能拿下的终极难题。 第二轮,Claude在Claude Code里拉起约60个子智能体,花了一天半时间,执行2400条Shell命令、写下数百个Python脚本,还围绕已知的黎曼ζ函数零点进行了数千次数值检验。 这60个智能体有的负责提出新思路,有的沿着重点方向继续推导,有的专门寻找反例,还有一批直接充当审稿人,负责给其他智能体挑错。 13个负责提供辅助想法,30个探索了其他方向但没能成功,13个专门验证论证,最后2个帮忙把成果整理成论文。

阅读原文(qbitai.com)→

行业新闻一水2026-08-11原文

相关内容