实测 MiniMax H3 视频生成:4090 租 GPU 单条低至 1.3 美分
Worldly_North_7213 · reddit · 2026-09-12
一位开发者用同一套 ComfyUI T2V 工作流(int8convrot 权重,共 67 GB,含 34 GB DiT 与 27 GB Qwen3-VL 编码器)、相同 prompt 与种子,在四家 GPU 租赁平台跑了 MiniMax H3 文生视频(864x480、20 步、5 秒短片),并公布完整计费数据:
- 稳态单条成本:Vast.ai RTX 4090(spot $0.40/h)93 秒/条、$0.013/条最便宜;RunPod 4090 $0.019;Nebius L40S $0.024;Hyperstack H100 PCIe 67 秒/条但 $0.038
- 两个反直觉发现:L40S 跑出接近 4090 的速度(3.97 s/步 vs H100 的 2.99 s/步);4090 借 ComfyUI 动态显存路径,以 23 GB 显存 + 68 GB 主机内存流式跑完 34 GB DiT——主机内存 ≥64 GB 是硬门槛,实测峰值 68 GB
- 短任务的钱都花在 session 开销上:67 GB 权重下载在 Vast 达 450 MB/s、Nebius 仅 104 MB/s,导致 Nebius 首条耗时 11.5 分钟(其他平台 1.8-2.7 分钟);换新 prompt 还要多花 15-25 秒文本编码
作者自述在做相关服务,但所有数据是自费 $1.67 跑出并公开了原始 CSV。对想低成本自托管视频生成的开发者是直接可抄的选卡与平台参考。
「Infra」频道最新
- 遭伊朗袭击后,阿联酋 5GW AI 园区改设计为抗打击分布式布局 — mark_k · 2026-09-12
- 单张 RTX 5090 跑 502GB 模型:DeepSeek V4.1-Flash 展示本地 AI 新架构 — AccBalanced · 2026-09-12
- 团队日跑100-200个Agent后发现:瓶颈已从算力变成磁盘空间 — vincent_koc · 2026-09-12
- Orca 发布 DeepSeek V4.1 Flash 去审查 MLX 权重,面向安全研究 — AccBalanced · 2026-09-12
- 逆向工程还原苹果 Neural Engine 内部架构 — zdw · 2026-09-12
- Qwen3.8-27B 上线 Cerebras,AAII 得分 34 比肩 GPT-5.6 Luna — Alibaba_Qwen · 2026-09-12