Epoch AI 用桌游测试 AI 能否从经验中学习
Jsevillamol · x · 2026-07-21
- Epoch AI 研究员 Greg Burnham 介绍了一个围绕桌游 Earthborne Rangers 搭建的基准测试,用来检验 AI 能否从经验中持续变强。
- 他们选择这款桌游,是因为它支持单人模式,而且几乎不依赖视觉或空间推理。
- 评测覆盖连续 5 天的游玩过程。结果显示,AI 初上手时表现已经很强,甚至往往比人类第一次玩得更好。
- 但当系统被要求继续游玩并做笔记后,性能基本没有提升:它们似乎并没有真正学会规则,也没有随着经验积累而进步。
- 这个基准的核心目的,是检验“首局很强”与“真正从经验中学习”之间的差距。
「漫话AGI」频道最新
- François Fleuret:人类只有「留在幼儿园」和与人机融合两条路 — francoisfleuret · 2026-09-11
- 「AI 竞赛中国论」遭反弹:一条 IG Reels 点出谬误获 50 万赞 — louisvarge · 2026-09-11
- 后 AI 时代没有边做边学,智能廉价到该提前学完 — rachittshah · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- AI 圈梗:改果蝇和 agent 集群也「值得冒险」吗 — dejavucoder · 2026-09-11
- nabla_theta:若 AI 乌托邦成真我乐意认错 — nabla_theta · 2026-09-11