清华研究:AI 智体能干活但难“反思”,RSI 遇瓶颈
TheTuringPost · x · 2026-08-26
清华大学研究团队分析了 1338 次 AI 后训练运行,揭示了通往递归自我改进(RSI)的一个关键瓶颈。虽然 AI Agent 能够执行训练、调试、评估和迭代等工作,甚至能持续数小时,但它们很少会停下来“思考”是否整个策略方向错了。一旦选定策略,Agent 倾向于固守,即使结果暗示应当重新考虑。增加内存、技能、反馈或 2-8 倍的推理算力并未打破这一模式。这表明“能迭代”不等于“能反思”,这是超越单纯后训练的更大问题。
「漫话AGI」频道最新
- 盖茨改口:AI 将造成经济灾难,岗位数将远少于今天 — MFordFuture · 2026-08-26
- 盖茨改口称 AI 将导致大规模失业:经济灾难或将来临 — MFordFuture · 2026-08-26
- AI 原住代的教育:2035 年的无限代币与自由 — RachelVT42 · 2026-08-26
- 学者调侃:学术版‘若能被真理摧毁,就该被摧毁’ — anderssandberg · 2026-08-26
- Delip Rao 炮轰播客收钱造势:AI 估值泡沫中的虚假叙事 — deliprao · 2026-08-26
- AI 监控的伦理困境:技术可行并不意味着我们该这么做 — DavidLinthicum · 2026-08-26