研究称新一代LLM改写让AI文本检测近乎失效
东京都立大学研究团队发现,随着大模型快速换代,期刊的 AI 写作筛查正系统性失效。在测试中,AI 文本检测器 Pangram 对被 Meta 的 Muse-Glimmer 模型改写的科学摘要漏检率高达 79.8%,而在 5000 篇人类撰写的摘要中仅有极少误报。研究者认为,若检测工具无法跟上新模型,期刊或将有约三分之一的 AI 参与稿件无法被识别。
2026-10-10 ~ 2026-10-10 · 2 条相关
- AI 文本检测器对 Meta 新模型改写摘要漏检近 80%,研究警示筛查失效 — rohanpaul_ai · 2026-10-10
- arXiv 论文:LLM 持续换代让期刊 AI 稿筛查系统性失效,或漏检三分之一 — rohanpaul_ai · 2026-10-10