Video-R1模型通过强化学习提升视频推理,7B模型超GPT-4o
视频推理刚刚得到了重大升级!
认识一下 Video-R1,今天 Hugging Face Papers 上的热门论文。受基于规则的强化学习启发,这个 MLLM 能够处理复杂的视频理解。
令人惊讶的是?7B 模型甚至在空间推理基准上超越了 GPT-4o!
认识一下 Video-R1,今天 Hugging Face Papers 上的热门论文。受基于规则的强化学习启发,这个 MLLM 能够处理复杂的视频理解。
令人惊讶的是?7B 模型甚至在空间推理基准上超越了 GPT-4o!