基座LLM缺乏推理能力,LRM或能解决
以下论文测试了多种基座LLM(无TTA)在泛化性数学问题上的表现,发现它们无法推理也无法做数学。
全部属实……但基座LLM不具备流体智能这一事实,虽然在2024年极具争议,如今已得到公认。一个有趣的实验是,用当前的LRM测试同样的问题并测量差异。我打赌最新的LRM能解决其中大部分问题。
https://t.co/GiyTJu0yAT
全部属实……但基座LLM不具备流体智能这一事实,虽然在2024年极具争议,如今已得到公认。一个有趣的实验是,用当前的LRM测试同样的问题并测量差异。我打赌最新的LRM能解决其中大部分问题。
https://t.co/GiyTJu0yAT