FastVideo 发布 4 步音视频生成模型,需 4 张 B200
NerdyRodent · x · 2026-08-29
FastVideo 发布了 FastH3 Preview v1 检查点,基于 MiniMax H3 模型,支持 4 次前向传播同步生成视频与音频。该模型采用 90% 稀疏度的 Data-Free DMD2 和 VSA-H3 技术蒸馏。默认配置需 4 张 B200 GPU 运行,若使用其他多 GPU CUDA 系统需调整特定参数。目前支持文本生成音视频,但在精细动作和音频细节上略逊于基座模型。
所属事件:MiniMax 开源 H3 视频模型,FastH3 v1 实现近实时生成(9 条相关)→
「多模态」频道最新
- MiniMax H3 在 ComfyUI 中实现 2 倍加速 — alisitskii · 2026-08-29
- Seedance 2.5 音频驱动口型同步演示 — justin_hart · 2026-08-29
- 模型自画像实验:Terra 似人 Sol 异形 Claude 抽象 — repligate · 2026-08-29
- MiniMax Music 3 生成两分钟以上音频现杂音或静音 — God_Hand_9764 · 2026-08-29
- 用 Grok Bot 和 fal 将推文变成情景喜剧 — altryne · 2026-08-29
- MiniMax H3 对比 BF16 与 INT8 Convrot 性能 — Glittering-Cold-2981 · 2026-08-29