prime rl 框架更新:支持多智能体强化学习与自博弈

willccbb · x · 2026-08-08

开源强化学习框架 prime rl 宣布支持多智能体系统的表达与训练。该更新旨在为智能体评判(agentic judge)、自博弈(self-play)、用户模拟以及复杂的智能体协作等场景提供支持。开发团队表示,他们在设计该软件抽象层时,着重兼顾了系统的可扩展性与运行性能。

所属事件:Prime Intellect 开源多智能体强化学习栈(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →