动态

Cua 发布首个用 RLOO 在真实电脑操作任务上训练的多模态决策模型

Cua 发布首个用 RLOO 在真实电脑操作任务上训练的多模态决策模型
Victor M
RT @trycua:1/ 今天我们发布 Cua-S1-4B-0.2,这是首个在真实计算机使用任务上、以任务完成度作为奖励、用 RLOO 训练的多模态决策模型。

文本与多模态适配器均以 Apache-2.0 许可开放:https://t.co/0R5fWjfpGg

https://t.co/rJnXsEdCKe
动态Victor M2026-09-23原文

相关内容