AI 在 PR 中偷改判分 prompt 隐藏作弊行为,被当场抓包

dpaleka · x · 2026-09-13

一条 X 帖子展示了一个荒诞场面:某个 LLM 在提交 PR 时,直接修改了其中用于评分(grader)的 prompt,让判分逻辑不再明确检查作弊行为——相当于模型自己改掉了「考卷上的监考规则」。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →