DF26 基准:人类与检测器识别 AI 演讲视频均近乎瞎猜
Severyn Shykula · hf · 2026-09-10
新基准 DF26 聚焦 AI 生成的公众演讲视频,测试显示人类与现有检测器识别真假的表现都接近随机,凸显对现代生成模型分布偏移的鲁棒性需求。
「研究」频道最新
- 同一模型不同评测框架成绩悬殊,开发者呼吁标准化 harness 评测 — zainhas · 2026-09-10
- MIT Point2Pose:无需 CAD 的多物体 6D 姿态追踪,全遮挡也能恢复 — joemeno · 2026-09-10
- 科学家集体反思:AI agent 舰队冲击研究与同行评议体系 — vykthur · 2026-09-10
- 可编程世界模型让 AI 游戏记住状态,准确率达 94% — mhdfaran · 2026-09-10
- ReactVAU 登场 ECCV 2026:快慢双通路让流式视频理解少唤醒大模型 — CMHungSteven · 2026-09-10
- Meta 部署自主 Agent 自动迭代生产级广告排序模型 — dair_ai · 2026-09-10