Prime Intellect 推出多智能体强化学习框架,支持智能体对抗与评估

willccbb · x · 2026-08-08

Prime Intellect 在 verifiers 0.3.0 和 prime-rl 0.8.0 版本中正式引入了多智能体系统支持,将其强化学习栈从单智能体扩展至多智能体场景。

开发者现在可以编程设定智能体间的任意交互,选择需要学习的角色,并在完整的交互过程中分配信用。该框架引入了 Agent 和 Env 两个核心抽象,原生支持多种交互模式:

所属事件:Prime Intellect 开源多智能体强化学习栈(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →