论文提出蜂群思维等价于单个强化学习智能体:Maynard-Cross 学习规则
tctjr · x · 2026-09-30
博主推荐论文《The Hive Mind is a Single Reinforcement Learning Agent》(Soma, Bouteiller, Hamann, Beltrame, arXiv:2410.17517)。论文不空谈"涌现",而是写下具体更新规则:一群遵循简单的局部纯模仿加权投票规则的智能体,在数学上等价于一个不断更新策略的单个抽象强化学习智能体,作者称之为 Maynard-Cross Learning。
论文关键词横跨群体智能、强化学习、演化博弈论与演化生物学,灵感来源是蜜蜂选巢的摇摆舞行为。博主认为这是群体智能文献中难得把机制说清楚的工作。
「研究」频道最新
- AutoBenchmark 后续:基准难度可迁移到未见过的新模型 — jaseweston · 2026-09-30
- AutoBenchmark 收官:循环停滞时人类定向介入有效,附博客全文 — jaseweston · 2026-09-30
- Meta AI 推出 AutoBenchmark:自动造基准,发现人类介入收益巨大 — jaseweston · 2026-09-30
- AVSD 被 NeurIPS 2026 接收:多视角特权信息自适应蒸馏改进 LLM 推理 RL — mohitban47 · 2026-09-30
- Reddit 开源 BabyCoder:本地小模型 Agent 会做梦、睡觉时提出新问题 — Illustrious_Matter_8 · 2026-09-30
- CoRL 2026 辩论会聚焦:机器人到底需不需要世界模型 — vincesitzmann · 2026-09-30