Cua 发布 Cua-S1-4B-0.2:首个用 RLOO 在真实电脑操作任务上训练的多模态决策模型

alexcovo_eth · x · 2026-09-24

Cua(trycua)推出 Cua-S1-4B-0.2,宣称是首个以 RLOO 算法在真实 computer-use 任务上、以任务完成度为奖励训练的多模态决策模型。文本与多模态适配器均以 Apache-2.0 开源发布,配套 GitHub 项目已获 26k+ star,提供跨 OS 机器人群、驱动与 benchmark,用于训练、评估与数据生成。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →