Video DeltaNet 开源:8 卡 B200 上 11 秒生成 14.4 秒视频
BigWideBaker · reddit · 2026-09-05
团队发布 VDN-Minimax-H3(VDN-H3),一个基于 MiniMax H3 的混合注意力视频生成模型,生成速度超过播放速度。
关键点:
- 推理速度:8 张 B200 上,8 步去噪 11.23 秒生成 14.4 秒视频片段
- 混合架构:帧级线性注意力分支负责高效计算,softmax 分支保持骨干模型的视觉质量与一致性
- 即插即用:新增线性注意力分支 + 两个小型 LoRA 适配器,推理时可合并进骨干网络,无需改动骨干权重
- 全开源:权重、优化后的推理栈与训练代码一并放出
所属事件:开源 VDN 视频生成提速 75–90 倍,快于播放速度(7 条相关)→
「多模态」频道最新
- Suno V6 音乐生成模型即将发布 — op7418 · 2026-09-05
- pyannote 说话人分离社区模型 1 登上 Hugging Face 热门榜 — pyannote · 2026-09-05
- 创作者用 fal H3 Max 搭建可乱入的 90 年代情景喜剧互动剧场 — gorkem · 2026-09-05
- Orbis 论文:将视频生成变为可持续运行的可控视觉过程 — rohanpaul_ai · 2026-09-05
- Pocket FM 年入 2 亿美元后砍掉旧模式,全面转向 AI 生产爆款 — thisguyknowsai · 2026-09-05
- Intangible 上线 Motion Paths:画一条线即可编排 3D 运动路径 — azed_ai · 2026-09-05