Yann LeCun称其Aleph agent在数学基准上获99.4%准确率 Logical Intelligence我们的Aleph agent,由@OpenAI的GPT-5.2驱动,在@gtsoukal等人的PutnamBench(最难的正式数学基准测试)上获得了668/672分,即99.4%的超高效率——这是自然语言自动代码生成的关键一步,将英语作为编程语言,且结果无幻觉。 动态Logical Intelligence2026-01-11原文 打开互动版