第三方评测争议:Pangram 是唯一靠谱的 AI 文本检测工具?
jackinwarsaw · x · 2026-09-03
Pangram 官方汇总第三方评测称其经受住检验:2026 年 6 月布鲁塞尔自由大学对四款检测工具(Pangram、GPTZero、Turnitin、Copyleaks)在 160 篇长论文上的测试中,仅 Pangram 可靠检出全 AI 文(97.5%)与人味化 AI 文(95%),其余三家几乎为 0%。
但回帖者 @jackinwarsaw 指出:NBER 论文(疑为 w34223)并未列入该第三方评测汇总页,且汇总中的 UMD 论文曾测得 Pangram 约 2% 的假阳性率(可能是 2025 年 5 月旧模型);对方回应称 NBER 即 UChicago 论文,在 2000 篇人类样本上假阳性率仅 0.1%,中长文本过滤后接近 0,且滑窗评测口径差异不应归咎 Pangram。
「模型」频道最新
- 开发者实测 Muse Spark 1.3:速度快、价格极低,Meta 打磨出惊喜 — Scobleizer · 2026-09-03
- mark_k 发帖暗示「GPT-6 之日」或临近发布 — mark_k · 2026-09-03
- GPT-Astra 临近发布爆料者补充两条证据来源 — kimmonismus · 2026-09-03
- Dan Jeffries:美国 AI 的出路是找到开源权重商业模式 — Dan_Jeffries1 · 2026-09-03
- Muse Spark开源模型即将发布,研究者呼吁公开更多技术细节 — eliebakouch · 2026-09-03
- 用户实测 Gemini 3.8 Flash:长上下文幻觉重、指令遵循差 — lxfater · 2026-09-03