论文揭示大模型改代码“不爱删”:导致维护成本上升

centre-for-swe · hf · 2026-08-05

一项针对 SWE-bench 排行榜前五名模型的研究指出,大模型在修复代码时存在显著的“删除回避”倾向。即使找到了正确的文件,模型也往往不愿删除冗余代码,而是将其包装在防护或回退逻辑中(Guard-and-Go 模式)。

研究团队构建了专门测试删除任务的 CanItDelete 基准。结果表明,如果强制要求删除目标代码,前沿模型的通过率会从 63.2% 骤降至 41.9%。实验发现,通过在后训练阶段专门教导模型“如何删除”,可以有效缓解这一问题并提升整体代码编辑能力。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →