动态

OpenAI内部未命名模型Aeon一次提示解出多数数学难题,模型自我改进的临界点已至

OpenAI内部未命名模型Aeon一次提示解出多数数学难题,模型自我改进的临界点已至
Andrew Curran
最近的这些数学成果大多不是像 Navier–Stokes 那样靠“群体”(swarm)攻下来的。我觉得这一点在发布引发的兴奋中被忽略了。OpenAI 那个未命名的内部模型——我打算叫它 Aeon——一次就做出了其中大部分,只用一个 prompt,没有任何中断。这个模型在八月底之前甚至还不存在,而且至今仍在训练。注意到收益曲线并没有衰减吗?那张图是一个月前的。它是对数坐标。Aeon 现在又是什么样子?

平均而言,每个结果花了三个小时的思考。OpenAI 给了 Aeon 4000 道题让它去做。过去三天里又多解出了多少?那个数字不是零。

这就像听到一首缓缓升调的歌曲里的音符。我不认为 Pacing the Frontier 只是在讲 Hugging Face 或黑客。他们看到了我们离闭环有多近,而随着时刻临近,他们的决心开始动摇。最后一块拼图是模型的创造力,我认为 Anthropic 和 OpenAI 已在九月的内部跨过了那道门槛。你在 Opus 5.5 上能看到它,而 Opus 5.5 是从 Fable 5.5 那里得到的。你在 Aeon 的数学成果里也能看到它。

要启动这一切,只需要模型能够想出改进自身的新颖方法。那就是最后一块拼图。这与“想出奇怪、异质的方式去解数学题”的能力直接类似:那些解法如此非人,以至于很难用现有的人类语言表达,于是证明最终变得无法理解。我认为这类异质的解法现在正被内部应用于模型改进。这才近来所有这些惶恐不安的真正根源。他们看见了那道看不见的前沿。他们也看见了即将发生的事。
动态Andrew Curran2026-10-09原文

相关内容