VELA 1.0 发布:非破坏性优化 MiniMax H3 视频,0.8MP 生成从 2:53 缩至 2:13
NoMouse9610 · reddit · 2026-10-08
开发者基于数周对 MiniMax H3/VDN 的性能调优,发布 VELA H3 1.0——它不是新模型,而是改变 H3 内部重计算的执行方式:对数值敏感的路径保持精确计算,安全的路径换用更快内核(「能快的快、该准的准」)。
结果(RTX 3090 Ti 24GB 实测)
- 0.8MP / 5 秒:VDN 1.1 为 2:53,加 VELA 后 2:13
- 更有意思的对比:原生 H3 20 步 vs VDN+VELA 8 步,动漫样例 8:07 → 3:03,写实样例 7:50 → 2:52,质量肉眼接近
- 作者诚实标注局限:增益随视频时长缩小,10 秒时反而略慢;2.7x 并非 VELA 单独贡献
调优中否决了大量方案(attention 后端、量化、低秩近似、QKV 路径等)——单独看更快,整体反而更慢或画面变化过大。VELA 完全 patch-free,不改动 ComfyUI 核心文件,按普通自定义节点安装,已上架 Comfy Registry,代码、基准与失败实验全部开源。
「多模态」频道最新
- AI 接力社区电影 The LoopHole Project 开放投稿,10 月 21 日截止 — LudovicCreator · 2026-10-08
- Reddit 用户分享 Qwen 2.1 写实出图工作流:CFG 3-3.5 加双 LoRA 组合 — Any_Tea_3499 · 2026-10-08
- 用 Imagine 2.5 生成复古杂志封面:为何看起来如此可信 — Own-Sample-2904 · 2026-10-08
- Midjourney 提示词分享:基尔利安摄影风情侣电光光环人像 — tisch_eins · 2026-10-08
- InSpatio-World 1.5 开源:单图/视频输入生成可导航 4D 世界 — liuziwei7 · 2026-10-08
- Opus 5.5 用 MCP 驱动 Blender+Suno,3.5 小时无人工做出音画同步神作 — sidahuj · 2026-10-08