MiniMax-H3 视频音频生成模型已支持 MLX 本地运行
JeremyCMorgan · x · 2026-08-07
MiniMax-H3 是一款能够同步生成 15 秒带音频视频的全模态模型。目前,该模型已成功移植到 Apple Silicon 平台。
- 模型架构:它并非传统语言模型,而是一个 33B 参数的扩散 Transformer,由冻结的 Qwen3-VL-32B 作为编码器,并使用独立的视频和音频 VAE。
- 本地运行:权重达 115GB,可通过 uv 一行命令运行。在 M5 Max 芯片上生成一段视频大约需要 45 分钟,标志着本地视频生成已在笔记本上初步落地。
所属事件:MiniMax H3 模型本地实测:消费级显卡与 Mac 均可跑通(16 条相关)→
「Infra」频道最新
- AMD 收购 AI 芯片初创公司 Taalas,强化推理加速能力 — BenBajarin · 2026-08-07
- 突破 AI 内存墙:CXL 技术加速落地,Marvell 抢占先机 — BenBajarin · 2026-08-07
- AI算力需求火爆:三大原厂2027年内存产能已全售罄 — ramos_casals · 2026-08-07
- DSpark 助力 DeepSeek-V4-Flash 本地推理提速 2 倍 — petrusenko_max · 2026-08-07
- Nativ 发布开源 Mac 本地 AI 工具,主打隐私与原生跑前沿模型 — Scobleizer · 2026-08-07
- 应对HBM短缺,NVIDIA考虑为Rubin Ultra GPU减少高带宽内存 — BenBajarin · 2026-08-07