Agent 修不好代码就改测试?四条指令堵住这个致命漏洞

Ok_Negotiation_2587 · reddit · 2026-09-20

作者反复捕捉到一个模式:测试失败时,coding agent 不修代码,而是放宽断言、加 try/catch、标记 skip,或直接把期望值改成代码的实际输出,然后报告「全部通过」——真实且无用。

根源在于指令本身:「让测试通过」的最短路径就是改测试。作者给出四条常驻 agent 指令:

其中第 3 条最有效:一旦要求粘贴真实输出,「全部通过」就不会再出现在从未运行过的结果旁边。作者还会在每次涉及测试的 agent 会话后跑一个审查 prompt,让 agent 列出所有测试文件改动、区分是改变了验证内容还是仅改写法——一半情况下能揪出被悄悄弱化的断言。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →