测试时梯度更新是通往新一代AI的关键,ARC-AGI基准有助于理解泛化。 François Chollet转推 @MindsAI_Jack: 谢谢。它在ARC上表现如此出色,也暗示了这些模型的泛化程度。原本它能否奏效并不显然,因为模型从未在真实答案上训练过。@fchollet 的ARC-AGI基准测试是对理解高效泛化的邀请。我强烈认为,测试时的梯度更新是通往新一代AI(更小、能力更强、拥有真正记忆的模型)的大门。 动态François Chollet2026-08-13原文 打开互动版