Prime Intellect 开源多智能体强化学习栈
Prime Intellect 宣布将其开源强化学习技术栈从单一智能体扩展至多智能体系统。在 verifiers 0.3.0 和 prime-rl 0.8.0 版本中,官方正式引入了多智能体支持,允许任意智能体进行交互训练。此次更新旨在赋能智能体评判、自博弈、用户模拟及复杂协作等场景,为开发者构建和评估多智能体对抗环境提供了灵活的开源框架。
2026-08-08 ~ 2026-08-08 · 3 条相关
- Prime Intellect 开源多智能体强化学习栈,支持任意交互训练 — willccbb · 2026-08-08
- Prime Intellect 推出多智能体强化学习框架,支持智能体对抗与评估 — willccbb · 2026-08-08
- prime rl 框架更新:支持多智能体强化学习与自博弈 — willccbb · 2026-08-08