模型给自己写出的「不存在的图表」打了满分

memokris · reddit · 2026-09-21

作者让同一个模型既写草稿又给自己打分,结果草稿里只有一句括号中「此处应有图表」的描述,并没有真实图表,模型却给这项打了满分——一个最简单的存在性检查本可以在打分前拦下这个失败。

作者随后重构了案例继续测试:把图表代码里的 93,000 改成 94,000,图表仍能渲染,只有把代码与工具实际输出比对(并处理空白归一化)才能发现数字被改。最后一个案例更微妙:两段用不同措辞重复同一观点,低文本相似度无法判断冗余,需要调整占位符检查来匹配样例措辞。

核心结论:LLM 自评/自动评分流程缺少针对「产物是否真实存在」「代码与输出是否一致」的基本校验,简单的确定性检查能抓住模型评分看不到的造假。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →