人大 ClawGym II:黑盒 RL 直接优化复杂 Agent 框架

RUC · hf · 2026-08-18

RUC 发布 ClawGym II,一个统一的黑盒强化学习框架,通过沙箱执行、轨迹重建与混合框架训练,实现对运行在复杂 agent harness 上通用 agent 的稳定、可扩展优化,无需白盒访问模型内部。

所属事件:人大发布 ClawGym II,黑盒 RL 直接训练复杂 Agent(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →