RTX 5060 Ti 跑 MiniMax H3 实测:分辨率是最大瓶颈
danielcar · reddit · 2026-08-14
开发者分享了在 AMD Strix Halo 核显上运行 MiniMax-H3 视频生成模型(配合 4 步 Turbo LoRA)的实测数据。测试发现,分辨率是最大的性能瓶颈而非采样步数:由于注意力机制与 token 数量呈平方关系,1344x768 分辨率的注意力计算量是 512x288 的约 49 倍,导致高分辨率生成在 16 分钟后仍卡在第一步。
此外,作者发现 Abiray 发布的量化权重文件存在损坏(末尾被追加了无效标记),导致 ComfyUI 无法加载。通过截断多余字节修复后,其哈希值与 Comfy-Org 发布的干净版本完全一致,建议新用户直接使用 Comfy-Org 版本。
「Infra」频道最新
- 曝 OpenAI 购入 Cerebras 4.2% 股份,为超快速模型发布铺路 — ryanmerket · 2026-08-14
- 黄仁勋回顾 DGX 十周年:新桌面机算力达初代 5 倍 — nvidia · 2026-08-14
- 英伟达携手 Runway:一天内将 Gen-4.5 引入 Vera Rubin 平台 — nvidia · 2026-08-14
- RTX 5090实测:SageAttention视频生成提速近2倍 — gabxav · 2026-08-14
- CoreWeave 推出沙盒环境:手机即可远程驱动 Claude 智能体 — wandb · 2026-08-14
- AI 算力基建遇阻?预测市场押注美国将出台数据中心禁令 — Polymarket · 2026-08-14