数学家 Strogatz 指出 Wolfram 囚徒困境实验缺了演化选择这一环
stevenstrogatz · x · 2026-10-06
数学家 Steven Strogatz 公开回应 Nassim Taleb,仔细剖析 Stephen Wolfram 近期用有限状态机枚举策略跑囚徒困境的实验(Wolfram 发现一些复杂策略大幅胜过 Tit for Tat)。
Strogatz 的核心论点:
- 他不质疑计算本身,也不为博弈论辩护,只想比较模拟与模拟
- Wolfram 做法很有特色:不手挑几个策略,而是枚举给定大小的全部有限状态策略,让每个策略与所有其他策略对弈,再按成绩排名
- 关键缺陷:只有一轮。胜出策略并没有变得更常见、失败者也没有变稀有——等于做了演化锦标赛的第一轮就停手
- 原始种群中大量「冤大头」策略(无条件合作者等),擅长剥削弱者的策略第一轮分数可以很亮眼
- 一旦用成绩更新种群再反复迭代,第 1 轮的赢家未必是第 10 轮、第 1000 轮的赢家,因为策略本身塑造了后续选择发生的环境
他援引 Martin Nowak 与 Karl Sigmund 数十年前的同类方法学工作作对照。全文由 Strogatz 撰写论点、ChatGPT 打磨语言。
「漫话AGI」频道最新
- 研究者反驳 Scott Aaronson:对齐是可解的 RL 问题,不是神学 — sebkrier · 2026-10-06
- 长文起底 AI 安全末日论者的互联网亚文化渊源 — ZeroStateReflex · 2026-10-06
- 用 Claude Code 三条 prompt 一小时做出域名查询工具,只因「我想让它存在」 — TheMoonMidas · 2026-10-06
- Runway CEO 引 Jevons 悖论:编码 Agent 正催生更多软件需求 — c_valenzuelab · 2026-10-06
- AI 研究者放话:不必等到明年夏天,RSI 可能已经正在发生 — coherence · 2026-10-06
- 投资人判断:个人 Agent 将是多赢家大市场,多群体需求各不相同 — vaibhavbetter · 2026-10-06