Wan 3.0 实测:物理逻辑大幅提升,支持 30 秒长视频
Fresh-Resolution182 · reddit · 2026-08-12
作者在相同的初始帧、提示词和随机种子(720p)下,对比了 Wan 3.0 与 2.7 版本的图生视频(I2V)能力,总结了实际体验后的升级与缺陷。
主要改进点:
- 物理与运动逻辑:3.0 在物体碰撞、碎裂(如玻璃掉落、台球开局)等物理效果上更贴近真实。动态逻辑(如芭蕾旋转时裙摆的跟随)也更干净利落。
- 稳定性:在运动过程中,主体和背景的保持更稳定,减少了 2.7 中常见的伪影。
- 长视频能力:3.0 支持生成 30 秒的视频片段(2.7 上限为 15 秒),且在长视频中能较好地保持人物身份和场景不发生突变。
已知 Bug:
- 随机镜头切换:即使提示词中没有镜头移动指令,3.0 也会在视频中途随机切换镜头,有时伴随重影溶解。这在普通 5 秒片段中也会出现,在 30 秒长视频中触发更频繁,严重破坏了连续镜头的完整性。
作者表示,尽管存在随机切镜的问题,但由于物理和长度上的显著优势,将逐步切换至 3.0,同时在需要纯净单镜头的快速迭代场景中保留使用 2.7。
「多模态」频道最新
- ComfyUI原生支持LTX-2.5:引入动态算力分配渲染 — Comfy-Org · 2026-08-12
- Midjourney 悄然发布 v8.2 版本更新 — azed_ai · 2026-08-12
- LTX 2.5 视频生成太慢?更换卷积 VAE 可提速数倍 — desktop4070 · 2026-08-12
- 独立开发者用 Claude Code 打造 macOS 本地图像生成应用 Diffusion Bus — deckarep · 2026-08-12
- 阿里夸克开源 LiveAvatar:14B 模型实时生成无限长数字人 — tom_doerr · 2026-08-12
- Flux 3 视频模型实测:生成 1990 年风格怪兽录像 — CurieuxExplorer · 2026-08-12