AI 灌水论文可否被检测引激辩, Leibo 预判将成可分离簇
DeepMind 研究者 Joel Leibo(账号 @joelbot3000)与 @cedcolas 围绕「AI 生成的 slop 论文能否被可靠检测」展开多轮辩论,核心分歧在于 slop 判断的主观程度,以及是否可作出可检验的实证预判。
已确认
- 双方立场:Leibo 认为真正的 slop 有明确特征——听起来高深实则空洞、不通往已有研究、没有真正衔接过去文献——因此识别并不那么主观;他也承认人类的敷衍论文同样存在。cedcolas 则区分「AI 风格的写作」与「AI slop」:前者可以做出检测器,后者本质主观,很难有可靠检测;他自述目前用 AI 写论文,认为结果并非 slop。
- Leibo 的可检验预判:用一两年后的 LLM 对 OpenReview 上所有投稿的初始版本做聚类,slop 论文会明显分离成独立的一簇,可与 LLM 辅助写作的论文及真诚的一年级博士生论文区分开。
尚未确认
- 该聚类预判本身是面向未来一两年的预测,尚无实证结果验证;后续讨论中也指出存在其他影响因素,结论有待检验。
为什么重要
- 若预判成立,将为「AI slop 论文可检测」提供实证依据,直接影响 OpenReview 等审稿平台应对 AI 灌水稿的政策;若不成立,则支持 slop 判断高度主观、难以自动检测的一方,对学术出版如何界定 AI 滥用有参考意义。
2026-09-25 ~ 2026-09-26 · 5 条相关
一手来源
- 研究者用 LLM 聚类论文,预判未来将现可分离的「AI 垃圾论文」簇 — joelbot3000 ·
- AI 风格写作不等于 AI slop:检测器能抓前者,后者难有共识 — cedcolas ·
- LLM 聚类 OpenReview 论文,slop 帖将成可分离的一簇 — joelbot3000 ·
- 【源头】AI 风格写作不等于 AI slop:检测器能抓前者,后者难有共识 — cedcolas · 2026-09-25
- joelbot3000:真正的 slop 不主观,「看似深刻实则空洞」可被分类 — joelbot3000 · 2026-09-26
- 【源头】研究者用 LLM 聚类论文,预判未来将现可分离的「AI 垃圾论文」簇 — joelbot3000 · 2026-09-26
- 【源头】LLM 聚类 OpenReview 论文,slop 帖将成可分离的一簇 — joelbot3000 · 2026-09-26
另有 1 条近重复转述:joelbot3000