行业新闻

人形机器人完成11分制乒乓球对局

人形机器人靠闭环感知-决策-控制完成11分制乒乓球对局,为验证自主能力提供新标尺。

两台人形机器人按乒乓球规则完整打完11分制比赛,该对局将亮相8月22日至26日在国家速滑馆举行的第二届世界人形机器人运动会,展示机器人高速感知、实时决策与全身控制能力。

正文摘录

这场对局,很快就要搬进 国家速滑馆「冰丝带」 。8月22日至26日, 第二届世界人形机器人运动会 将在这里举行。 乒乓球正是其中一档节目。参与表演的是由香港大学与超维动力KAI研究团队组成的 港大超维战队 。开幕式上,他们的机器人还将与几位乒乓球名将同场过招。 这机器人的抬手、挥拍,一套动作有模有样。只见红帽小哥和蓝帽小哥一交手,电光石火之间…… 它并非一个大模型从头包办到底,而是一套将视觉感知、轨迹预测、动作规划和全身控制串起来的闭环方案。 为此,他们把SMASH从1.0升级到了 2.0 。机器人的击球范围从相对固定的来球扩展到长球和短球,还补上了自主发球。 队伍领队 罗平 是香港大学计算与数据科学学院副院长、MMLab HKU负责人,也是超维动力联合创始人。 为什么偏偏选择乒乓球?机器人打完一局,和过去接住几个球有什么不同?离真正挑战人类选手,还有多远? 罗平: 人和机器人打时,人会下意识地喂球,让机器人尽量能够回球。两个机器人对打时,双方的目标都是赢球。既要主动进攻,又要让比赛真正打起来,要求会高很多。 罗平: 不是。完整11分指按照乒乓球规则完整打完一局、分出胜负。11个回合,或者说连续七八拍,则是同一个球在得分前来回对拉七八次。 罗平: 我们自己的两台机器人使用同一套SMASH系统。正式比赛面对其他队伍时,每支队伍都有自己的模型和系统。 目前可以为机器人预设不同策略,比如偏快、偏慢或者选择不同落点,但还没有做到在与某个对手交手的过程中实时学习。只有实现在线学习,机器人才能进一步针对具体对手调整打法。 机器人对打产生的数据会被保存下来,用于后续的真机强化学习。成功和失败的回合都积累下来,之后才有可能形成所谓的 自进化 。现阶段的训练数据仍然以人类数据为主。 罗平: 这届比赛中,乒乓球和自由搏击是少数要求机器人完全自主完成的项目,不允许遥控。

阅读原文(qbitai.com)→

行业新闻听雨2026-08-17原文

相关内容