Prime Intellect RL 栈升级:支持多智能体系统训练与评估

willcb · x · 2026-09-29

Prime Intellect 宣布其开源 RL 训练栈 PRIME-RL 从单个智能体扩展到多智能体系统训练,可编程任意智能体间交互、选择哪些角色学习、并在完整交互链路上分配 credit。

这是 agentic RL 基础设施的一次实质性扩展,开源可复用。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →