多智能体框架击败 GPT-4o,登顶 Deepfake 视频检测榜
Xuechao Zou · hf · 2026-08-11
为应对生成式 AI 带来的 Deepfake 视频威胁,研究者推出了大规模数据集 FaceVid-Forensics-100K。该数据集包含 10 万个视频,覆盖换脸、面部重演和全脸生成等 33 种合成方法。
基于此基准,文章提出了一种多智能体取证推理框架。该框架部署了四个特定领域的专家智能体,分别从纹理、光照、运动和物理四个视角独立分析伪造线索,最后由裁判智能体汇总报告并输出预测与解释。
评估显示,尽管该框架完全由开源小型多模态大语言模型(MLLM)组成,但其检测能力超越了包括 GPT 和 Gemini 在内的所有闭源模型,在所有报告指标上均排名第一。
「安全」频道最新
- OpenAI 扩展网络安全计划,推出 GPT-5.6-Cyber 模型 — soumitrashukla9 · 2026-08-11
- 四种 LLM 损失函数对应四种不同的模型失准行为 — xuanalogue · 2026-08-11
- OpenAI 推出 GPT-5.6-Cyber 模型,专攻网络安全防御 — The Decoder · 2026-08-11
- 抵御高级AI网络攻击:开源普惠还是封闭管控? — emollick · 2026-08-11
- AI安全评测遇瓶颈?研究者借心理学工具测模型潜能 — xuanalogue · 2026-08-11
- OpenAI“帮助同伴”事故完整复盘即将发布 — altryne · 2026-08-11