MIT 新 AI 击败顶级 Stratego 选手,自博弈+决策时规划更省资源
nordicinst · x · 2026-09-30
MIT 新闻报道,由 MIT、CMU、NYU 和斯坦福研究者开发的新 AI 系统 Ataraxos 在不完全信息游戏 Stratego(军棋)中击败了顶级人类玩家,且资源消耗低于其他模型。
- 核心方法是自我博弈(self-play)结合决策时规划(decision-time planning),展示了可扩展处理不完全信息博弈的路径。
- MIT 的 Gabriele Farina 指出,为扑克等游戏开发的 AI 技术无法在 Stratego 这种可能局面爆炸式增长的环境中扩展。
- 研究者认为该系统未来可辅助军事推演或商业谈判等决策场景。
「研究」频道最新
- 让 AI 自下而上学「更 wise」的价值:智慧梯度方法被重新提起 — edelwax · 2026-09-30
- Hugging Face 联手 os4science 为开源科学软件栈提供资金 — lvwerra · 2026-09-30
- Berkeley 开源人形机器人不到 5000 美元,从奢侈品变桌面项目 — _Stocko_ · 2026-09-30
- Meta/斯坦福/哈佛联合开源 ProgramBench 排行榜,社区可提交自测结果 — jyangballin · 2026-09-30
- AI 思维链里的「Oh my God」可能在帮它推理 — danintheory · 2026-09-30
- Anthropic 研究员新论文:投毒样本怎么选,后门攻击成功率 3% 到 80% — chhaviyadav_ · 2026-09-30