行业新闻

OpenAI 数学证明发布未达数学家顾问组标准

OpenAI 数学证明发布未达数学家顾问组标准

OpenAI 放出 719 份数学难题解答,却被指未遵守数学家顾问组的标准:人类读不懂的证明,到底算不算解出来?

OpenAI 本周公开数百份针对世界级数学难题的解答,称已咨询数学家顾问组,以避免上次争议重演。但这些解答并未达到顾问组设定的标准——数学家尤其强调人类要能理解结果。新论文还指出,OpenAI 声称解决的一道百万美元级难题,其自然语言证明与形式化代码之间存在出入。

正文摘录

OpenAI 本周 [发布](https://github.com/openai/math) 了数百份号称针对世界上一些最难数学问题的解答。这家前沿实验室表示,它此前咨询了一个由顶尖数学家组成的顾问小组,以避免重蹈上次其某个模型解决该领域一个长期悬而未决问题时所引发的 [争议](https://techcrunch.com/2026/09/08/openai-fought-dirty-on-career-making-math-problem-says-nyu-mathematician/)。 但 OpenAI 没能达到这些标准,尤其是在数学家们强调的「人类必须理解数学结果」这一点上。这一点在下面这件事之后尤其令人担忧:一篇新论文指出,对于一个号称由 OpenAI 模型解决的、价值百万美元的问题,其自然语言解法与形式化解法之间存在差距。 数学与人工智能顾问小组(Advisory Group on Mathematics and Artificial Intelligence,AGMAI)由普林斯顿大学高等研究院(Institute for Advanced Studies)主办,成员是来自全球各机构的九位知名研究者。 该组织在 9 月底发布了面向解决数学问题的前沿实验室的 [指南](https://agmai.org/general-sep29/)。在就最新一批证明发表的声明中,AGMAI 表示:「我们的建议在多大程度上得到了成功落实,最终要由数学界来评估。」 然而,该组织的第一个请求就是「停止在专有模型上测试高等数学问题」。而 OpenAI 的发布内容明确表示,它正是在用开放的数学研究问题来评估其专有模型。 当 TechCrunch 请求对 OpenAI 最新发布的这批证明做更全面的评估时,该顾问小组没有回应。

阅读原文(techcrunch.com)→

行业新闻Tim Fernholz2026-10-08原文

相关内容