清华研究:AI 智体能干活但难“反思”,RSI 遇瓶颈

TheTuringPost · x · 2026-08-26

清华大学研究团队分析了 1338 次 AI 后训练运行,揭示了通往递归自我改进(RSI)的一个关键瓶颈。虽然 AI Agent 能够执行训练、调试、评估和迭代等工作,甚至能持续数小时,但它们很少会停下来“思考”是否整个策略方向错了。一旦选定策略,Agent 倾向于固守,即使结果暗示应当重新考虑。增加内存、技能、反馈或 2-8 倍的推理算力并未打破这一模式。这表明“能迭代”不等于“能反思”,这是超越单纯后训练的更大问题。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →