动态

VLAct:面向VLA的视觉语言骨干,开源,性能领先

VLAct:面向VLA的视觉语言骨干,开源,性能领先
Yukang Chen
转推 @YSenqiao: 🦾扩展机器人数据至关重要。但在构建VLA时,我们不断思考一个补充问题:除了数据扩展,如何让骨干网络从相同轨迹中学习到更具迁移性的知识?🤔

来自StarVLA团队,认识VLAct——一个以表征为中心的持续预训练构建的面向VLA的VLM骨干。

🚀 RoboTwin 2.0上达92.5%
🌍 在RoboDojo上领先所有世界动作模型
⚡ 在16个GPU上完成持续预训练
🔓 数据、代码、模型和训练流程全面开源
更多结果和见解请见线程 🧵👇
动态Yukang Chen2026-08-31原文

相关内容