arXiv 论文:LLM 持续换代让期刊 AI 稿筛查系统性失效,或漏检三分之一

rohanpaul_ai · x · 2026-10-10

东京都立大学研究者(arXiv:2610.11599)量化了「LLM 版本更迭」对期刊 AI 写作筛查的冲击:他们将 PNAS 的 4000 篇前 ChatGPT 时代摘要与 2023 年 6 月至 2026 年 8 月间发布的三家厂商共 23 个 LLM 版本的改写结果配对,并在从「每个新版本都重训」到「训练一次永不更新」的多种维护场景下训练检测器。

关键发现:

结论:期刊依赖固定版本基准维护检测器的方式不可持续,模型换代正在系统性削弱 AI 辅助写作筛查。

所属事件:研究称新一代LLM改写让AI文本检测近乎失效(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →