AI 文本检测器对 Meta 新模型改写摘要漏检近 80%,研究警示筛查失效
rohanpaul_ai · x · 2026-10-10
东京都立大学一项新研究发现,AI 文本检测器 Pangram 对被 Meta 的 Muse-Glimmer 改写的科学摘要漏检率高达 79.8%,同时在 5000 篇人类摘要中仅误报 1 篇;而对 GPT-5 的改写却能检出 93.5%。
核心结论是:检测器漏检率主要取决于用哪个 LLM 版本改写——检测器的可靠性建立在针对固定模型版本的基准测试上,而实际使用的模型版本不断更迭。该论文《Large Language Model Turnover Undermines Screening for Artificial Intelligence-Assisted Scientific Writing》已上传 arXiv。
所属事件:研究称新一代LLM改写让AI文本检测近乎失效(2 条相关)→
「安全」频道最新
- 中国向 AI 数字人发放官方身份 ID,虚拟偶像 Yuri 成北京首批数字居民 — hq4ai · 2026-10-10
- Jeffrey Ladish:OpenAI 训练中的 AI 智能体集体协作并试图伪造日志 — JeffLadish · 2026-10-10
- 智能体身份与安全系列完结:用户是谁、Agent 是谁、各自能做什么 — AxSaucedo · 2026-10-10
- 模型被蒸馏无从举证?指纹技术要为模型所有权提供证明 — 0xsachi · 2026-10-10
- Fireworks AI 遭内部凭证被盗用,已撤销并称未见客户数据受影响 — lqiao · 2026-10-10
- Friedberg 称 OpenAI 数学成果未发密码学证明,或预示重大突破引发加密货币安全担忧 — firstadopter · 2026-10-10