fal 重构 MiniMax H3 Max,开源视频模型提速 35 倍、GPU 利用率翻倍
gorkem · x · 2026-09-18
- a16z 采访 fal 的 Gorkem Yurtseven 和 Batuhan Taskaya:MiniMax 上月发布开源视频模型 H3 后,fal 对其推理链路重构——削减生成步数、重写各阶段底层代码,把 GPU 利用率从常见的 30-40% 提到理论峰值的 70-80%,速度提升 35 倍且无质量损失。现在视频生成比实拍还快,用户已不再关心速度和价格,竞争焦点转向质量与 prompt 遵循度。
- 专业工作流:VFX 从业者流行先用 Blender 低分辨率渲染场景作为参考输入 AI 模型,获得接近 100% 的可控性;H3 Max 上线一周内,还涌现出「LLM(Astra) 生成 Blender 场景→喂给 H3 Max」的全新管线。Hollywood 一年前还不是客户,现在需求已经变了。
所属事件:fal 将 MiniMax 开源视频模型提速 35 倍,逼近实时生成(5 条相关)→
「Infra」频道最新
- 澳大利亚拟立法强制 AI 公司上报失控事件,2027 年初落地 — gaganghotra_ · 2026-09-18
- HEIF Heist:一个图像解析漏洞波及OpenAI、Slack、Meta、GitHub — Miles_Brundage · 2026-09-18
- NVIDIA 推 CUDA-Q Logical 编排层,助 Fermilab 研发提速 7 倍 — CurieuxExplorer · 2026-09-18
- 算力中端市场缺标准层:1000 万至 1 亿美元级部署何时能标准化交易 — AccBalanced · 2026-09-18
- 已规划数据中心达 342GW,是现装机的近 7 倍,隐含 26 万亿美元开支 — BenBajarin · 2026-09-18
- Qwen Code 遇大目录 glob 触发堆 OOM:每目录缓存一份 gitignore 匹配器 — XxCotHGxX · 2026-09-18