VLAct:面向VLA的视觉语言骨干,开源,性能领先
转推 @YSenqiao: 🦾扩展机器人数据至关重要。但在构建VLA时,我们不断思考一个补充问题:除了数据扩展,如何让骨干网络从相同轨迹中学习到更具迁移性的知识?🤔
来自StarVLA团队,认识VLAct——一个以表征为中心的持续预训练构建的面向VLA的VLM骨干。
🚀 RoboTwin 2.0上达92.5%
🌍 在RoboDojo上领先所有世界动作模型
⚡ 在16个GPU上完成持续预训练
🔓 数据、代码、模型和训练流程全面开源
更多结果和见解请见线程 🧵👇
来自StarVLA团队,认识VLAct——一个以表征为中心的持续预训练构建的面向VLA的VLM骨干。
🚀 RoboTwin 2.0上达92.5%
🌍 在RoboDojo上领先所有世界动作模型
⚡ 在16个GPU上完成持续预训练
🔓 数据、代码、模型和训练流程全面开源
更多结果和见解请见线程 🧵👇