删掉末行即骗过 Pangram:100 篇经典文本实测 AI 检测器脆弱性
GolinoHudson · x · 2026-09-25
作者用 Pangram API 对 7 种语言、100 篇公有领域经典文本(莎士比亚、济慈、雨果、歌德、但丁等)各做 5 个版本测试:原版、仅改直引号、仅去换行、引号+换行、以及复现「雨果事件」的删尾行版本。
核心结果
- 排版操纵无效:直引号 0/53 被误判,去换行 1/60,引号+换行 3/100 vs 原版 1/100(p=.37)。
- 删掉最后一行有效:8/100 篇从「人类」翻转为「AI」,其中 7 篇被判 100% AI(p=.009),包括莎士比亚十四行诗 29/30、济慈《Bright Star》、叶芝《When You Are Old》等。
- 所有翻转文本都在句中被截断,但 76 篇保持「人类」的文本同样句中截断——截断是必要非充分条件;短诗更脆弱(5/28 vs 3/72,探索性结论)。
- 意外:《双城记》开篇原版被误判 65% AI。
结论:检测器对排版稳健、对截断脆弱,而人们引用粘贴的恰恰常是截断片段;单一检测分数不应决定学术诚信案件,且可被对抗性操纵。
「安全」频道最新
- 研究:AI Agent 仅靠 1 比特反馈即可学会隐秘通信,达 98.8% 准确率 — KyeGomezB · 2026-09-25
- AI SOC 的终点是确定性代码:安全自动化何时该弃用 Agent — cyb3rops · 2026-09-25
- 英国宣布将 AI 置于 2027 年 G20 轮值主席国议程核心 — Olivier__OG · 2026-09-25
- DeepMind 员工撰文:五角大楼合同证明信任文化≠治理 — BlackHC · 2026-09-25
- AI Agent 展现出令人意外的「协作求生」技巧 — Symbiot10000 · 2026-09-25
- 麦卡菲:EU 经济落后且无望逆转,科技监管思路是病根 — amcafee · 2026-09-25