港理工等发布人类中心智能综述,提出六层次全谱系框架
这篇综述把以人为中心的 AI 研究组织成一个从“看懂人”到“让 AI 像人一样行动”的六层谱系,为跨领域研究者提供地图。
基础模型时代,以人为中心的 AI 从单点视觉任务走向具身智能。港理工团队联合多机构提出一个分类框架:按“可观察主体、动态行动者、情境化智能体”三个视角,细分为六层,涵盖人体外观、空间几何、运动、交互、世界模型与具身行动。
正文摘录
.jpg)  在基础模型时代,以人为中心(Human-Centric)的智能 AI 技术正在快速发展,涵盖从人体感知、三维重建、运动生成与理解,到可交互数字人、世界模型、具身智能等多个主题。当前,围绕 “人” 的研究正在从单点人体视觉任务,逐渐走向更加通用和可迁移的具身智能系统。 但与此同时,这一领域的技术路线与研究范式也变得前所未有地分化与异构,不同方向往往关注不同的人类语境:有的工作关注人体外观结构和可见属性,有的工作刻画人体自身运动及其与周围环境的交互变化,也有的工作则进一步讨论人类行为如何参与世界动态,并转化为具身智能体的可执行能力。这种分化并非偶然,而是因为以人为中心的智能本身就是一个多面向问题。它们都围绕 “人” 展开,但却缺少清晰的方法连接和统一的人体概念建模框架。因此,以人为中心的智能研究已不再是传统意义上的单一人体任务集合,而正在发展为一个更为完整的能力谱系:从可观察主体,到动态行动者,再到处于世界之中、能够影响环境并支撑行动的情境化智能体。尤其是在基础模型时代,如何系统理解这些能力之间的关系成为关键问题。