深伪检测论文:真实场景掉点明显
markjeffrey · x · 2026-07-17
BitMind 发布了其 deepfake 检测相关论文与评测结果:他们指出,很多检测器在学术基准上表现不错,但到了真实世界内容上,AUC 往往会下降 45–50%,认为这反映了生成模型持续进化带来的结构性问题。
他们用 19 个公开 benchmark 对一版冻结模型做了统一评测,不针对单个数据集微调,结果达到或超过多篇论文中的最强结果,包括 Deepfake-Eval-2024 上最好的商业检测器。论文的评测 harness 公开,生产 API 也服务的是同一评测快照,便于外部复核。
「安全」频道最新
- Anthropic 发布迄今最详细威胁情报报告,披露 Claude 被滥用案例 — TinfoilTricorn · 2026-09-11
- Wired 深度解析:为何众多 AI 研究者担心机器威胁人类生存 — wiredmagazine · 2026-09-11
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- a16z 播客:两三人小团队为何在政策讨论中集体失声 — a16z Podcast · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- 集体诉讼指控 Anthropic 用模糊用量倍数夸大 Claude 订阅权益 — The Decoder · 2026-09-11