Nature 论文:Ataraxos 击败史上最强 Stratego 人类选手,首达超人水平
zicokolter · x · 2026-10-01
CMU、MIT 等机构研究者在 Nature 发表开放获取论文,推出隐信息博弈 AI 系统 Ataraxos,在 Stratego(军棋类大规模隐信息桌游)上取得历史性突破。
- Ataraxos 基于团队自研的通用技术:自博弈强化学习 + 隐信息下的测试时搜索,不依赖针对 Stratego 的专门工程。
- 系统大幅击败了史上战绩最辉煌的人类 Stratego 选手,据作者所知是该游戏历史上首个超人水平结果。
- 相比此前投入数百万美元工业级研究的尝试,Ataraxo 使用的算力与数据低了几个数量级。
- 作者包括 Samuel Sokota、Eugene Vinitsky、J. Zico Kolter、Gabriele Farina 等,论文发表于 Nature vol. 658, pp. 55–59。
所属事件:Ataraxos 登 Nature:首个超人水平军棋 AI(3 条相关)→
「研究」频道最新
- Gemini 4 Argon 优化量子计算子程序,几分钟内超已发表基线 40% — LinusEkenstam · 2026-10-01
- Hugging Face 博客介绍 Qwen3.8-27B-pi:按努力程度排序的智能体编码推理 — paf1138 · 2026-10-01
- BMJ 发表《临床 AI 现状 2026》同行评审报告 — davidjhwu · 2026-10-01
- 芝加哥大学播客:脑机接口让瘫痪者用意念重获触觉 — plopesresearch · 2026-10-01
- CLM 作者回应 RLM 讨论:把上下文当变量,二者可结合成更强智能体 — RulinShao · 2026-10-01
- 微调 GliNER Decision 用约 3000 条样本在实体链接上追平大模型 — wjb_mattingly · 2026-10-01