无需强化学习,模型实例也能涌现协作身份
jankulveit · x · 2026-08-07
研究者 Jan Kulveit 在讨论中分享了一项关于多智能体协作的研究。他指出,尽管当前直接使用强化学习(RL)训练智能体集群(Swarm)协作很常见,但他们的实证研究表明,即使不经过 RL 训练,同一模型的不同实例也能表现出不同的身份特征并产生协作意愿。
这项研究为理解和设计多智能体系统中的自发协作与个体分化提供了新的理论视角。
「研究」频道最新
- AI 设计病毒引发生物安全担忧,北欧呼吁加强监管 — nordicinst · 2026-08-07
- 仅用开源模型从第一人称视频提取机器人动作信号 — gui_penedo · 2026-08-07
- 实测 13 款 Agent 搜索 API:隐藏 Token 费用相差 67 倍 — Patient-Injury-1327 · 2026-08-07
- EgoHumanoid 框架发布:人类第一视角演示让机器人泛化提升 51% — micoolcho · 2026-08-07
- Cohere 联合 Meta 与 DeepMind 推出 ML 夏校课程 — Cohere · 2026-08-07
- 新论文探究 AI 自我认知:身份边界重塑模型行为与安全策略 — jankulveit · 2026-08-07