实测 Pangram 检测器:去 AI 味技巧全无效,亲写初稿才过关
PawelHuryn · x · 2026-08-16
作者花 8 小时实测 Substack 内置的 AI 检测器 Pangram,结论是:网上流传的「去 AI 味」偏方对检测器完全无效,唯一能过关的是自己动手(打字或口述)写第一稿。
核心实验发现
- 常见建议(删掉破折号、改用简化技术英语)确实能改变文风,但代价是文章读起来像宜家说明书,而且骗不过检测器。
- 他把一份草稿重写三遍、换标点换词,分数纹丝不动;逐行润色一份 AI 草稿、连自己的错别字都保留,仍被判 25% 人类;甚至自己收集好观点、素材和实验结果交给 AI 起草,照样被标记。
- 唯一通过的方式:亲笔写第一稿,之后让 AI 大幅改写,依然 100% 判为人类;口述也算数。
三个不同的问题要分开看
- AI slop 由读者定义:读者不跑检测器,他们感受到的是「范式转移」式套话堆砌、自我鼓掌("Here's the kicker")、虚假热情、说完两句话就复述——简化英语和删破折号一条都治不了。
- AI 检测看的是第一稿谁写的:谁起草决定判定结果,与后续修改量无关。
- AI 水印看的是哪个模型选的词:Anthropic 将在未来 Claude 模型中加入文本水印,用密钥影响模型选词,读者不可见、仅持钥方可验证——所以他那份被判 100% 人类的 AI 改写稿,恰恰是水印能抓到的。到处都有效的唯一技巧是完全不用 AI。
两点观察:喊得最响的「AI slop」批评者,多是靠「写得比别人好」建立地位的人;而大多数读者远没有想象中在意——重要的不是句子谁写的,而是打开 agent 之前你有没有真东西可说。
「模型」频道最新
- Gemini 3.7 Flash 评测排名升至第 7 — aronchick · 2026-08-16
- Gemini 3.7 Flash对标GLM 5.2,GLM 5.3将开源 — zainhas · 2026-08-16
- 网友预测:Qwen4-27B 将在笔记本上跑 Fable 级画质 — SumitGup · 2026-08-16
- 实测 DeepSeek V4 Max:耗时更长但成本仅 23 美元 — burny_tech · 2026-08-16
- Grok 4.6 编码智能体效率超 GPT-5.6 Sol,成本低 35% — rohanpaul_ai · 2026-08-16
- Qwen3.6-27B 无审查微调版登 HF 热榜,支持视觉输入 — HauhauCS · 2026-08-16