专题 · FULL STORY

Pangram 误判真人写作风波持续发酵

9 月初开发者吐槽 AI 检测器 Pangram 频繁将规范真人写作误判为 AI 生成,随后又有作者实测发现仅经 AI 润色的自写文章被判 100%「AI 垃圾」,误判争议持续发酵,引发对检测工具可靠性的质疑。

2026-09-04 ~ 2026-09-11 · 2 集 · 11 条

第 1 集 · AI 检测器 Pangram 频误判规范真人写作引群嘲(2026-09-04,7 条)

9 月 4 日,开发者 aronchick 连发多条帖子吐槽 AI 文本检测工具 Pangram:他用三段式排比、牛津逗号等标准英文写作习惯写的整页文字,频繁被误判为 AI 生成;更糟的是工具不指出任何被标记的具体位置或理由,让他无法针对性修改,他直斥其判定「纯靠感觉」。事件引发多位网友跟进吐槽与调侃。

已确认

  • aronchick 把自己 12 年前在 Amazon 写的最后一份 PRFAQ 提交给 Pangram 检测,被判定为 100% AI 生成。他自嘲说,这份经过 124 轮人工修订、数周打磨的文档「原来全是 AI 写的」
  • Byrne Hobart(经 Jeremy Nguyen 转发)指出,口碑尚可的 Pangram 有几种知名失败模式:听说的误判案例、多年前写的学校作文被标为 AI 等,并提醒其局限
  • mike64t 调侃 Pangram 的判定逻辑:只因句中用了「which is precisely why」这类再普通不过的表达就被标记为「一看就是 AI 生成」
  • mattslotnick 发梗图调侃此事:有人的文字被 Pangram 频繁标记,以至于开始相信自己就是一个大语言模型,反映此类误判已成圈内普遍困扰

为什么重要

  • 该事件再次暴露 AI 检测器对「写得规范」的真人作者的系统性误报问题:遵循标准写作规范反而成为被误判的原因,连正常的口语化连接词也可能触发标记
  • 检测工具不提供被标记位置和理由,被误判者缺乏申诉与修改的途径,这在学术、职场等依赖检测结果的场景下影响更大

第 2 集 · AI 检测器 Pangram 误判润色文章为「AI 垃圾」引争议(2026-09-10,4 条)

AI 内容检测工具 Pangram 的误判问题引发讨论。一位作者实测发现,自己撰写的段落仅用 AI 清理措辞和语法(观点与论证均为本人所写),就被 Pangram 判定为「AI SLOP」,修改后重测仍被判 100%。经济学家 Afinetheorem 也质疑学界零容忍阈值,称仅经 AI 文字编辑润色的文章在 Pangram 检测中持续获得 3-5% 的 AI 分,凸显 AI 检测工具在学术场景的可靠性问题。