FastVideo 发布 4 步音视频生成模型,需 4 张 B200

NerdyRodent · x · 2026-08-29

FastVideo 发布了 FastH3 Preview v1 检查点,基于 MiniMax H3 模型,支持 4 次前向传播同步生成视频与音频。该模型采用 90% 稀疏度的 Data-Free DMD2 和 VSA-H3 技术蒸馏。默认配置需 4 张 B200 GPU 运行,若使用其他多 GPU CUDA 系统需调整特定参数。目前支持文本生成音视频,但在精细动作和音频细节上略逊于基座模型。

所属事件:MiniMax 开源 H3 视频模型,FastH3 v1 实现近实时生成(9 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →