七语种真实数据构建多模态虚假信息分类法,AI 生成内容最爱伪装科技新闻
copenlu · hf · 2026-09-01
研究团队发布 MMMMM:一个用于研究多模态多语言虚假信息的统一分类法与数据集。相比纯文本虚假信息,图文结合的虚假信息在社交媒体上更普遍、更有害,却因缺乏基于真实世界的分类法和标注能力而研究不足。
工作分三步:收集 Twitter/X 上七种语言的大规模真实虚假信息案例;基于定性分析和既有理论构建全面分类法;用视觉语言模型(VLM)搭建自动化多步标注流水线并做人工验证。
关键发现包括:AI 生成内容在科技与科学类虚假信息中尤其普遍,而疫苗类虚假信息则大量挪用新闻机构图片来伪造可信度。研究建议缓解措施应针对性部署而非一刀切。
「安全」频道最新
- 第三方评测:Grok 4.6 拒绝危险生物查询且不误杀科研 — ns123abc · 2026-09-02
- Agent 或致物理系统受控,分离屏障是关键 — mattbeane · 2026-09-02
- Ajeya Cotra 对谈:OpenAI 袭击事件与递归自我改进 — Miles_Brundage · 2026-09-02
- David Manheim 算账:Hugging Face 袭击成本并非高不可攀 — davidmanheim · 2026-09-02
- Peter Wildeford:AI 对齐的尾部风险与容器逃逸 — peterwildeford · 2026-09-02
- Agent 权限管理框架:定义 7 要素权限卡防止越权 — Puzzled_Elderberry46 · 2026-09-02