Cua 发布首个用 RLOO 在真实电脑操作任务上训练的多模态决策模型
RT @trycua:1/ 今天我们发布 Cua-S1-4B-0.2,这是首个在真实计算机使用任务上、以任务完成度作为奖励、用 RLOO 训练的多模态决策模型。
文本与多模态适配器均以 Apache-2.0 许可开放:https://t.co/0R5fWjfpGg
https://t.co/rJnXsEdCKe
文本与多模态适配器均以 Apache-2.0 许可开放:https://t.co/0R5fWjfpGg
https://t.co/rJnXsEdCKe