实测证明 LLM 盲目修 Bug 会毁掉正确代码

sebpaquet · x · 2026-08-09

作者指出,LLM 审查代码时本质上只是在寻找「看起来像 Bug」的模式,而许多正确代码也可能符合这种模式。

为验证强行修复的后果,作者设计了一个对抗性循环实验:让模型不断审查并修复一段已被数学证明完全正确的算法。结果显示,模型在早期迭代中误判并破坏了原本正确的逻辑;随后在修复新报错时又不断引入新的 Bug,最终导致代码彻底崩溃。这表明,缺乏有效约束的 AI 自动审查与修复循环不仅无法优化代码,反而会带来毁灭性破坏。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →