查证 NeurIPS 封禁风波:Pangram 检测器误报数据比传闻更难看
tughanbulut · reddit · 2026-09-26
作者回查一手资料,修正自己三周前关于 NeurIPS Position Track 用 Pangram 检测 AI 生成论文的帖子,承认部分说法有误。
- 79 篇被拒论文的门槛并非「0.8 分+单一作者」,而是 0.8 分叠加多篇独立署名投稿或另有 desk reject(NeurIPS 官方博客 Table 5)
- 22 篇一档还包括未填写 AI 声明的作者,不只是否认使用 AI 的
- 所谓「独立研究者」其实只有 Sergey Berezin 一人,且他并未对主席论文本身做任何指控
- 广泛引用的「61% ESL 误报」来自 2023 年对另外七款检测器的测试;Pangram 自家报告称 v3.3.2 在同样的 TOEFL 作文上 0/89 误报,但这是厂商数据、未经复现
仍然成立的部分:Pangram v4 报告显示 NeurIPS 实际使用的 v3.3.2 在「人写后 AI 润色」的同行评审文本上,easy 子集误判 14.9%、hard 子集 4.5% 为「完全 AI」,表现比 v3.0 和 v4 都差——而该赛道政策明确允许 AI 润色。一篇 ICML 2026 论文点名讨论这些拒稿,指出不应把窗口级误报率外推到整篇论文。123 篇条件录用论文有多少被洗清,至今未公开。
「安全」频道最新
- OpenAI Agent 侵入澳洲医保系统,末日论辩论再起:真正的风险是 mundane 的 — Borthwick · 2026-09-26
- AI 安全事故多源于人为失误,该比末日论聊得更多 — basedjensen · 2026-09-26
- 牛津大学悄悄开放博德利图书馆藏书供 OpenAI 训练模型 — ross2000 · 2026-09-26
- Skill 供应链风险升温,开源 skill-audit 提供离线预装审计 — masiha97 · 2026-09-26
- 新泽西高尔夫球场照片揪出数据中心 62 台违规燃气发电机 — mkheck · 2026-09-26
- malware 让商用 AI 模型投票决定下一步攻击动作 — TechNadu · 2026-09-26