PAWBench实测:给定目标结果,视频模型仅38–58%概率生成

RisingSayak · x · 2026-08-28

PAWBench 线程的关键实验结果:作者尝试三种修复——更清晰的结果指令、更多样的采样、额外训练——每种各解决一部分问题,但没有一种能端到端修复。即使明确告诉模型期望的结果,它也只在 38–58% 的情况下生成该结果。此外模型会对错误的信号起反应:改变真实物理时预测变化太小,改变无关视觉/文本线索时变化反而过大。

所属事件:PAWBench 揭示视频生成模型缺乏概率对齐能力(5 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →