fal 把开源视频模型提速 35 倍,好莱坞成增长最快客户
a16z · x · 2026-09-18
a16z 采访 fal 的 Gorkem Yurtseven 与 Batuhan Taskaya,讲述如何将 MiniMax 开源的 H3 视频模型提速 35 倍:削减生成步数、重写各阶段底层代码,把 GPU 利用率从通常的 30-40% 提到理论峰值的 70-80%,且无质量损失。关键判断:
- 视频生成已快过实拍,价格与速度不再是用户痛点,竞争焦点转移到质量与 prompt 遵循度
- 好莱坞一年前还不是客户,如今是 fal 增长最快的客群,用于延长镜头、移动机位、调整灯光等「小修改」,成功率约 80-90%,fal 目标是 99.9%
所属事件:fal 把 MiniMax 开源视频模型提速 35 倍,好莱坞成最快增长客户(2 条相关)→
「Infra」频道最新
- Google 联手 Speakeasy 将整套 OpenAPI SDK 生成工具开源 — _philschmid · 2026-09-18
- 开发者自建 CUDA/Rust 推理栈,目标把 65 美元/十亿 token 的模型跑更快 — idanbeck · 2026-09-18
- Terafab 不是芯片厂而是「一座城」:整合最碎片化的供应链 — JOBhakdi · 2026-09-18
- Ben Bajarin:算力走向同质化,超大规模云厂商重构数据中心经济学 — BenBajarin · 2026-09-18
- Android 端 LLM Studio:离线跑模型、本地生图还能当 AI 服务器 — Miserable_Bird5822 · 2026-09-18
- AMD 拟对 GPU、芯片组乃至 CPU 全面提价约 10% — FullstackSensei · 2026-09-18