清华团队提出 EMERGE-Policy:用多智能体协作整合异构机器人模型
把 VLA、世界模型、验证器当成可调度的工具,由多个智能体分工协作完成长程机器人操作任务——这是对「单模型包打天下」思路的一次系统性替代。
清华大学深圳国际研究生院李秀教授团队联合多所高校提出 EMERGE-Policy,一个多智能体异步并发框架。它不追求单个模型包办一切,而是把 VLA(视觉-语言-动作模型)、世界模型、验证器等异构模型封装成统一技能库,由主智能体调度、角色化子智能体分工,让系统级智能在协作中涌现。
正文摘录
.jpg)  在长期的机器人操作(Robot Manipulation)研究中,单模型(如视觉语言动作模型,Vision-Language-Action,VLA)被广泛研究。然而,单一种类模型难以应对复杂的长程任务与突发干扰。[](https://mp.weixin.qq.com/s/aPjlKTb7AdMH7KtrVd2qg) 为此, 清华大学深圳国际研究生院智能计算实验室硕士生方智睿,于清池,陈子扬等在李秀教授的指导下,联合多家高校 推出了 全新的多智能体异步并发框架 ——EMERGE-Policy 。它打破了过去各项技术割裂研究的局面, 将 VLA、WAM、世界模型、验证器等不同架构和用途的模型整合为系统可调用的「多元工具集」。