行业新闻

25 位菲尔兹奖得主联署声明:AI 刷题式解题与数学界目标错位

菲尔兹奖得主联名警告:AI 把解数学题变成刷分指标,正在挤掉数学的理解与传承,值得关注的是背后两套评价体系的分叉。

25 位菲尔兹奖得主(数学界最高荣誉获得者)联署发布声明,称 AI 公司把解数学难题当作 benchmark(模型能力的评测基准)来刷分,与数学共同体追求概念理解、方法沉淀和知识传承的目标严重错位,可能割裂代际间的人类知识传递链。

正文摘录

刚刚,陶哲轩、邓煜等 25 位菲尔兹奖得主联合发起并作为首批签署人,发布了一份声明表示:AI 公司推进数学的方式,已经与数学共同体的目标出现 "severe misalignment(严重偏移)"。 因鉴于近期 AI 急剧发展对数学领域带来的冲击极为严峻,发起人未走流程繁琐的协商程序,而是选择紧急公开发布,以尽快回应危机。 过去几个月,大语言模型的数学能力急剧提升,已经能解决多个数学领域中重大的未决问题;但 AI 公司越来越倾向于把解决数学问题当作 benchmark 来推进的做法,对数学这门科学、对数学共同体都是有害的。AI 公司的目标与数学共同体的目标严重错位。我们认为,这属于更广泛的错位问题的一部分,影响着其他科学与创意职业,乃至整个社会。 本周关于 Navier-Stokes 的实践更是成为直接导火索,促使 25 位菲尔兹奖得主在过去一周紧急商议,并迅速发表此联名公开信。 首先要说明,这份声明并不是呼吁 or 要求停止 AI,或停止用 AI 来主导/辅助数学研究工作,也没有否认 AI 取得的这些成果。 第二,AI 公司追求 benchmark 成绩,数学界追求方法、理解和知识传承,两套评价体系开始分叉。 第三,当 AI 能快速完成开放问题后,数学研究的优先权、人才培养和开放文化都需要重新定规则。 几日前,OpenAI 宣布用 1 万个 Agent 跑了 88 小时,解决 Navier-Stokes(构造平滑外力使流体有限时间爆破,符合克雷题面 C、D 情形)这一千禧年难题,而后引发了一场连环抓马,将纽约大学数学家 Tristan Buckmaster 和 Anthropic 研究员 Levent Alpöge 这两名人类一同裹挟进舆论场。 (故事具体详情可见:《难评!

阅读原文(qbitai.com)→

行业新闻衡宇2026-09-12原文

相关内容