FDT 十年无进展?决策论者质疑 MIRI 式框架并提新方向
jessi_cata · x · 2026-10-09
jessicata 在与 @MatriceJacobine 的对齐/决策论讨论中提出:一些 MIRI 风格的研究者十多年来一直套用「FDT!TDT!逻辑反事实!」同一套框架却未取得成功,不如换用不同概念来思考事前最优性(ex ante optimality)与自我修改下的稳定性。
在被追问时她补充:自己并不认为 FDT 是良定义的(well-posed),但在多种情境(如不完美回忆 imperfect recall)下讨论事前最优性是有意义的,向 Newcomb 类问题的扩展也可能可行。这是一场关于决策论基础在 AI 对齐研究中是否走入死胡同的实质性观点交锋。
「漫话AGI」频道最新
- 「电脑能跑过山车大亨」≠「过山车大亨是电脑」:AI 意识争论的逻辑病 — AndyMasley · 2026-10-09
- Alexandr Wang 力挺 AI 数学突破:创新不该被知识守门人把关 — beffjezos · 2026-10-09
- 研究者观察:智能可以 scale,可理解性却在随之变差 — fkasummer · 2026-10-09
- 「数学末日」之下:把数学比作艺术能否服人? — littmath · 2026-10-09
- 数学博士因 LLM 带来多年未见突破,宣布离开数学学术界 — mishig25 · 2026-10-09
- 「思考可以外包,理解不能」:一句话点破 AI 时代的认知边界 — salykova_ · 2026-10-09