罗福莉谈AI范式巨变:从预训练转向Agent后训练,组织与资源加速调整
AI研究核心从预训练转向后训练,Agent范式下RL scaling成关键,影响资源分配与组织架构。
嘉宾罗福莉
节目简介
AI范式从预训练(大规模无监督学习)转向后训练(基于强化学习的Agent优化)。罗福莉指出,Claude Opus 4.6等模型验证了Agent路径,国内团队需加速追赶,调整GPU分配比例(预训练与后训练1:1),并重组组织以适应多样性需求。
AI研究核心从预训练转向后训练,Agent范式下RL scaling成关键,影响资源分配与组织架构。
嘉宾罗福莉
AI范式从预训练(大规模无监督学习)转向后训练(基于强化学习的Agent优化)。罗福莉指出,Claude Opus 4.6等模型验证了Agent路径,国内团队需加速追赶,调整GPU分配比例(预训练与后训练1:1),并重组组织以适应多样性需求。