从视频中学习因果,结合RL训练基础模型动作。
RT @HaiyuWu1: 首先从互联网视频的潜空间中学习因果性,然后使用强化学习教基础模型如何行动。
这种方法在预训练上比Gemini 3.1 Flash便宜30倍,并取得更好结果。JEPA就是一切!
然而,动作仍然在后训练中学习。如何在没有动作标签的情况下自动学习动作仍然非常重要!
这种方法在预训练上比Gemini 3.1 Flash便宜30倍,并取得更好结果。JEPA就是一切!
然而,动作仍然在后训练中学习。如何在没有动作标签的情况下自动学习动作仍然非常重要!