深度跃迁发布世界动作模型 DELE-w0.5 不依赖视频生成
深度跃迁发布新模型 DELE-w0.5,不走视频生成路线,直接预测动作,用较低成本实现稳定的机器人操作,值得关注。
深度跃迁发布世界动作模型 DELE-w0.5。它不走视频生成路线,而是在训练时联合学习动作与动作完成后的未来世界表征,推理时直接根据语言和视觉信息生成动作,避免高维视觉计算。在 640 次真机实验中,完整任务成功率达 62.5%,即使微波炉门被意外关闭,机器人也能保留任务目标并调整动作完成操作。
深度跃迁发布新模型 DELE-w0.5,不走视频生成路线,直接预测动作,用较低成本实现稳定的机器人操作,值得关注。
深度跃迁发布世界动作模型 DELE-w0.5。它不走视频生成路线,而是在训练时联合学习动作与动作完成后的未来世界表征,推理时直接根据语言和视觉信息生成动作,避免高维视觉计算。在 640 次真机实验中,完整任务成功率达 62.5%,即使微波炉门被意外关闭,机器人也能保留任务目标并调整动作完成操作。