多智能体框架击败 GPT-4o,登顶 Deepfake 视频检测榜

Xuechao Zou · hf · 2026-08-11

为应对生成式 AI 带来的 Deepfake 视频威胁,研究者推出了大规模数据集 FaceVid-Forensics-100K。该数据集包含 10 万个视频,覆盖换脸、面部重演和全脸生成等 33 种合成方法。

基于此基准,文章提出了一种多智能体取证推理框架。该框架部署了四个特定领域的专家智能体,分别从纹理、光照、运动和物理四个视角独立分析伪造线索,最后由裁判智能体汇总报告并输出预测与解释。

评估显示,尽管该框架完全由开源小型多模态大语言模型(MLLM)组成,但其检测能力超越了包括 GPT 和 Gemini 在内的所有闭源模型,在所有报告指标上均排名第一。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →