Logan解释Gemini 2.5通过三个轴并行创新实现性能提升 NomoreIDLogan(@OfficialLoganK)表示,Gemini 2.5之所以能取得如此惊人的性能,是因为Google在预训练、后训练和强化学习(RL)三个轴上并行创新和扩展。他说,与其他两个轴相比,RL更容易扩展。他解释说,每个轴的增益不是线性的,而是乘数性的。例如,预训练中1%的改进会在后训练中被放大,并在推理(RL)阶段进一步指数级放大。他预测Google将继续在这三个领域投资,以利用这种乘数效应。 动态NomoreID2025-07-21原文 打开互动版