GPT-5.6 90 分钟构造反例 破解统计学 20 年悬案
GPT-5.6 用 90 分钟证明了统计学金标准 BH 程序在特定条件下的漏洞,展示了 AI 的创造性数学推理能力。
统计学20年未解问题——在相关双侧高斯检验下,经典BH程序(控制多重假设检验假发现率的方法)是否始终有效?GPT-5.6从零构造反例,证明BH程序会失效。伯克利教授惊叹于AI的创造性数学构建,同时感慨“多希望这是人类完成的”。
正文摘录
 新智元报道  困扰统计学界整整20年的核心悬案,被 AI 击碎了。 近日,宾夕法尼亚大学沃顿商学院统计学教授 Edgar Dobriban 发了一条推文,引爆了一场学术圈地震。 主角是 OpenAI 旗下的 GPT-5.6。仅仅90分钟。  对理论统计学家而言,历史在此刻被粗暴地折叠了。 消息一出,数学圈的人士纷纷表达内心的激动。 一位数学家说,自己和同事多次尝试用 GPT-5.5 解决,从未成功。如今这个问题居然被 AI 解决了,实在是难以置信。他也开始思考,理论统计学家未来的出路是什么?