AI 文本检测器对 Meta 新模型改写摘要漏检近 80%,研究警示筛查失效

rohanpaul_ai · x · 2026-10-10

东京都立大学一项新研究发现,AI 文本检测器 Pangram 对被 Meta 的 Muse-Glimmer 改写的科学摘要漏检率高达 79.8%,同时在 5000 篇人类摘要中仅误报 1 篇;而对 GPT-5 的改写却能检出 93.5%。

核心结论是:检测器漏检率主要取决于用哪个 LLM 版本改写——检测器的可靠性建立在针对固定模型版本的基准测试上,而实际使用的模型版本不断更迭。该论文《Large Language Model Turnover Undermines Screening for Artificial Intelligence-Assisted Scientific Writing》已上传 arXiv。

所属事件:研究称新一代LLM改写让AI文本检测近乎失效(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →