无需强化学习,模型实例也能涌现协作身份

jankulveit · x · 2026-08-07

研究者 Jan Kulveit 在讨论中分享了一项关于多智能体协作的研究。他指出,尽管当前直接使用强化学习(RL)训练智能体集群(Swarm)协作很常见,但他们的实证研究表明,即使不经过 RL 训练,同一模型的不同实例也能表现出不同的身份特征并产生协作意愿。

这项研究为理解和设计多智能体系统中的自发协作与个体分化提供了新的理论视角。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →