fal 拆解 H3 Max:把 MiniMax 视频模型做到准实时生成
a16z · youtube · 2026-09-18
a16z GP Jennifer Li 对话 fal 联合创始人 Gorkem Yurtseven 与工程负责人 Batuhan Taskaya,聊生成视频进入实时时代的工程实践。
- H3 Max 是 fal 基于 MiniMax 开源视频模型做后训练的版本,靠模型后训练 + 系统与硬件协同优化大幅压低生成时延并保住质量。
- 速度解锁了「连续视频」实验:直播流能记住此前场景,并在运行中响应新指令(上线次日就做了 Twitch 实时演示)。
- 团队认为下一步瓶颈不在速度而在可控性:运镜、灯光、角色、动作、口型同步——专业创作者需要可预测的工具,而非一次性 prompt 出片。
- 还讨论了推理成本、芯片占用与流式体验的经济账,以及对创作者经济和好莱坞级工作流的影响。
完整时间戳目录见原视频。
所属事件:fal 把 MiniMax 开源视频模型提速 35 倍,好莱坞成最快增长客户(2 条相关)→
「Infra」频道最新
- Google 联手 Speakeasy 将整套 OpenAPI SDK 生成工具开源 — _philschmid · 2026-09-18
- 开发者自建 CUDA/Rust 推理栈,目标把 65 美元/十亿 token 的模型跑更快 — idanbeck · 2026-09-18
- Terafab 不是芯片厂而是「一座城」:整合最碎片化的供应链 — JOBhakdi · 2026-09-18
- Ben Bajarin:算力走向同质化,超大规模云厂商重构数据中心经济学 — BenBajarin · 2026-09-18
- Android 端 LLM Studio:离线跑模型、本地生图还能当 AI 服务器 — Miserable_Bird5822 · 2026-09-18
- fal 把开源视频模型提速 35 倍,好莱坞成增长最快客户 — a16z · 2026-09-18