提出统一VLA模型,将智能分解为动作令牌 DailyPapers新调查!研究人员提出了一个统一的视觉-语言-动作(VLA)模型框架:智能被分解为一系列“动作令牌”。它揭示了机器人如何将视觉和语言解释为可执行的步骤。这是具身智能的新视角! 动态DailyPapers2025-07-03原文 打开互动版