MiniMax H3 在 RunPod 上的实测吞吐量与成本
Yasangas · reddit · 2026-08-22
用户在 Reddit 询问 MiniMax H3 视频生成模型在 RunPod 上的实际运行表现。重点包括:
- 在不同 GPU 配置(如 4090, A100, H100)下的吞吐量。
- 每小时能生成多少 16:9 分辨率的 5-15 秒视频片段。
- 是否使用 INT8 量化、block offloading 或 4-step Turbo LoRAs 来加速。
- 目的是估算生成单个视频的实际成本。
「Infra」频道最新
- Parsewave 案例预示 AI 训练转向高质量数据合成 — trashnash007 · 2026-08-22
- GLM 5.2 跑出 35t/s 生成速度,DwarfStar 实现 Agent 级推理 — antirez · 2026-08-22
- 美数据中心建设受阻致算力外迁,电力瓶颈成关键 — Dan_Jeffries1 · 2026-08-22
- GLM-5.3 推理提速 21 倍,Kimi 线性解码优化内核实测 — teortaxesTex · 2026-08-22
- 博主实测:为何去印度搭双 3090 跑 Qwen 本地模型 — Ubunta · 2026-08-22
- 实测 KV 缓存混合技术,预填提速 3 倍 — maddie-lovelace · 2026-08-22