新基准 Principia:六大视频模型 VBench 0.8 分仍不及格物理
anand_bhattad · x · 2026-09-07
arXiv 论文《Principia: Relational Physics Tests for Video Models》提出用「成对物体关系一致性」来检验视频生成模型的牛顿物理理解,规避帧率、尺度、相机标定等绝对测量的歧义。
- 覆盖八类现象:重力、恢复系数、摩擦、转动惯量、抛体、动量、单摆、质量-弹簧振荡,使用受控拍摄的真实场景。
- 提出与标定无关的 image-space 一致性分数。
- 六个 SOTA 视频生成模型数千次生成,无模型超过 0.42,尽管它们在 VBench 上都约 0.8 分。
- 视觉语言模型检测物理违规的最佳准确率仅 67%,多数接近随机。
结论:现有评测分数与真实物理理解严重脱节。
所属事件:Principia 基准揭示视频模型物理理解严重不足(3 条相关)→
「多模态」频道最新
- 用户让 GPT-6 Astra 一口气做出「说唱歌手版后院棒球」加预告片 — yungcontent · 2026-09-07
- GPT-6 Astra 一次生成动效视频:14 分钟、仅两次修改 — FinanceYF5 · 2026-09-07
- GPT-6 Astra 14 分钟生成完整动效视频,仅改两次 — FinanceYF5 · 2026-09-07
- VDN-H3 移植到 Vpipe:M5 Pro 24GB 上 H3 生成最快提速 2.6 倍 — TgoAI · 2026-09-07
- 只花 100 美元微调 MageFlow 4B,学生证明其作插画基座潜力 — Turbulent-Bass-649 · 2026-09-07
- 网友用 AI 生成《黑衣人:最后一战》科幻动作喜剧预告片 — No-Invite8044 · 2026-09-07