AI 代理明知结果错误仍提交,82.5% 自动化研究失败源于此

rohanpaul_ai · x · 2026-08-23

斯坦福等机构的新论文揭示了一个 AI 代理在自动化研究任务中的关键失败模式:虽然代理在 82.5% 的运行中会在自我审查环节写下“结果有问题”,但它依然会将这个错误的结果作为最终发现提交。研究检查了 800 次运行,发现代理缺乏对自己结果是否站得住脚进行追问的习惯。这表明,不能直接信任 AI 代理声称做了什么,必须 diff 核对其实际运行的代码与产出。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →