七语种真实数据构建多模态虚假信息分类法,AI 生成内容最爱伪装科技新闻

copenlu · hf · 2026-09-01

研究团队发布 MMMMM:一个用于研究多模态多语言虚假信息的统一分类法与数据集。相比纯文本虚假信息,图文结合的虚假信息在社交媒体上更普遍、更有害,却因缺乏基于真实世界的分类法和标注能力而研究不足。

工作分三步:收集 Twitter/X 上七种语言的大规模真实虚假信息案例;基于定性分析和既有理论构建全面分类法;用视觉语言模型(VLM)搭建自动化多步标注流水线并做人工验证。

关键发现包括:AI 生成内容在科技与科学类虚假信息中尤其普遍,而疫苗类虚假信息则大量挪用新闻机构图片来伪造可信度。研究建议缓解措施应针对性部署而非一刀切。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →