单卡跑 MiniMax-H3:六种本地优化方案盲测横评
Primary-Confusion504 · reddit · 2026-08-11
为了让 33B 参数、原文件高达 385GB 的 MiniMax-H3 视频模型能在单张 RTX 5090 上流畅运行,作者对比了六种基于 INT8 量化和 ConvRot 的优化方案。
- 测试规模:使用 28 个提示词,在固定种子下生成了 168 个视频片段。
- 优化方向:在已应用 SageAttention2 和 FBCache 的基础上,对比了稀疏注意力(如 Sol Attention)、减少采样步数以及 4-8 步蒸馏 LoRA 的效果差异。
- 交互评测:作者搭建了网页盲测平台,用户可以隐藏标签投票选择最佳画质,或直接浏览带有生成耗时标注的全部 168 个片段。
「Infra」频道最新
- RTX Pro 6000 Blackwell 架构 NVFP4 GEMM 优化指南 — HanGuo97 · 2026-08-11
- CoreWeave 进军亚太:将在印尼建设 360MW 数据中心 — Beth_Kindig · 2026-08-11
- OpenAI 被指削减云服务用量,Datadog 大客户续约后降级 — SumitGup · 2026-08-11
- 曝微软计划“大幅”增产下一代自研 AI 芯片 — thoefler · 2026-08-11
- fal 签下 3 家生成式 AI 大厂,正扩充 H200 与 B300 算力 — gorkem · 2026-08-11
- Alphabet 拟发债融资 250 亿美元,重金押注 AI 算力基建 — Beth_Kindig · 2026-08-11