专题 · FULL STORY
Pangram 误判真人写作风波持续发酵
9 月初开发者吐槽 AI 检测器 Pangram 频繁将规范真人写作误判为 AI 生成,随后又有作者实测发现仅经 AI 润色的自写文章被判 100%「AI 垃圾」,误判争议持续发酵,引发对检测工具可靠性的质疑。
2026-09-04 ~ 2026-09-11 · 2 集 · 11 条
第 1 集 · AI 检测器 Pangram 频误判规范真人写作引群嘲(2026-09-04,7 条)
9 月 4 日,开发者 aronchick 连发多条帖子吐槽 AI 文本检测工具 Pangram:他用三段式排比、牛津逗号等标准英文写作习惯写的整页文字,频繁被误判为 AI 生成;更糟的是工具不指出任何被标记的具体位置或理由,让他无法针对性修改,他直斥其判定「纯靠感觉」。事件引发多位网友跟进吐槽与调侃。
已确认
- aronchick 把自己 12 年前在 Amazon 写的最后一份 PRFAQ 提交给 Pangram 检测,被判定为 100% AI 生成。他自嘲说,这份经过 124 轮人工修订、数周打磨的文档「原来全是 AI 写的」
- Byrne Hobart(经 Jeremy Nguyen 转发)指出,口碑尚可的 Pangram 有几种知名失败模式:听说的误判案例、多年前写的学校作文被标为 AI 等,并提醒其局限
- mike64t 调侃 Pangram 的判定逻辑:只因句中用了「which is precisely why」这类再普通不过的表达就被标记为「一看就是 AI 生成」
- mattslotnick 发梗图调侃此事:有人的文字被 Pangram 频繁标记,以至于开始相信自己就是一个大语言模型,反映此类误判已成圈内普遍困扰
为什么重要
- 该事件再次暴露 AI 检测器对「写得规范」的真人作者的系统性误报问题:遵循标准写作规范反而成为被误判的原因,连正常的口语化连接词也可能触发标记
- 检测工具不提供被标记位置和理由,被误判者缺乏申诉与修改的途径,这在学术、职场等依赖检测结果的场景下影响更大
- AI查重工具Pangram把大白话正常表达也标成AI生成 — mike64_t · 2026-09-03
- AI 检测器 Pangram 的失败模式:私人日记也会被误判 — JeremyNguyenPhD · 2026-09-04
- 坚持规范写作反而被误判:Pangram AI 检测器频标真人 — aronchick · 2026-09-04
- AI 检测器误伤老派写作者:牛津逗号也被判为 AI — aronchick · 2026-09-04
- AI 检测器 Pangram 频繁误判真人写作为 AI — aronchick · 2026-09-04
- 12 年前写的亚马逊 PRFAQ 被 AI 检测器判为 100% AI 生成 — aronchick · 2026-09-04
- 梗图:写手被 AI 检测器反复误判,开始怀疑自己是 LLM — matt_slotnick · 2026-09-04
第 2 集 · AI 检测器 Pangram 误判润色文章为「AI 垃圾」引争议(2026-09-10,4 条)
AI 内容检测工具 Pangram 的误判问题引发讨论。一位作者实测发现,自己撰写的段落仅用 AI 清理措辞和语法(观点与论证均为本人所写),就被 Pangram 判定为「AI SLOP」,修改后重测仍被判 100%。经济学家 Afinetheorem 也质疑学界零容忍阈值,称仅经 AI 文字编辑润色的文章在 Pangram 检测中持续获得 3-5% 的 AI 分,凸显 AI 检测工具在学术场景的可靠性问题。
- 作者实测 Pangram:自己写的段落仅润色语法即被判「AI 垃圾」 — pwlot · 2026-09-10
- 作者实测 Pangram:自己写的段落仅润色语法即被判「AI 垃圾」 — pwlot · 2026-09-10
- AI 检测器 Pangram 误判人写文章为「AI SLOP」引争议 — zetalyrae · 2026-09-10
- AI 检测阈值之争:仅 AI 润色的文章也常达 3-5% Pangram 分 — Afinetheorem · 2026-09-11