伯克利推出 CUA-Lite:统一计算机使用智能体的开放训练评测平台
dawnsongtweets · x · 2026-09-01
Dawn Song 团队(伯克利 RDI)发布 CUA-Lite,一个面向计算机使用智能体(CUA)的开放平台,试图解决当前 agents、环境、traces、训练框架四层各自为政的碎片化问题。
核心内容:
- 统一 agent 与环境的标准化接口和动作空间,覆盖桌面、浏览器、移动三端
- 统一 trace 格式(LiteSample),一个 agent 的 rollout 数据可直接训练其他 agent
- Lite.Gym 一个框架打通 eval → SFT → RL 全流程,RL 支持 GRPO、GSPO 等(基于 Slime)
- 可选 VM-free Docker 沙箱,无需 /dev/kvm,内存 CPU 占用不到原方案 1/4,单机可并行跑多个实例
已集成资源: 10+ CUAs(GPT、Claude、Gemini、Qwen、UI-TARS 等)、15+ benchmark(OSWorld、WebArena、AndroidWorld 等)、30K+ 可验证任务、10+ 数据集已上架 Hugging Face 免费下载,并附独立复现的 leaderboard。项目由其博士生 Zhanhui Zhou 主导,社区驱动开源。
所属事件:伯克利开源 CUA-Lite 统一计算机使用智能体训练评测(2 条相关)→
「编程与Agent」频道最新
- 开源 CommerceAgentBench,Qwen 跃居开源模型榜首 — Alibaba_Qwen · 2026-09-01
- 实测发现:Agent 查“此人是谁”几乎全死路 — Dry_Steak30 · 2026-09-01
- 整合 Posthog 与 Notion,Agent 自动化用户访谈与反馈闭环 — lennysan · 2026-09-01
- 用 Grok Bot 构建大学录取数据集清洗流 — lennysan · 2026-09-01
- 构想 Grok Bot 钱款漏洞猎人应用 — lennysan · 2026-09-01
- 从 Discord 机器人到多人共享 Agent 工作区:团队工作流升级记 — steipete · 2026-09-01