ComfyUI 节点优化:MiniMax H3 生成耗时锐减 30%
nnorbbi · reddit · 2026-08-07
开发者发布了一个针对 ComfyUI 原生 MiniMax H3 模型的轻量级无依赖补丁节点 MODEL,通过 FirstBlockCache 技术显著提升了生成速度。
在 RTX 5090 上使用 INT8 ConvRot 模型进行的固定种子基准测试显示:
- 原生注意力机制:耗时从 90.64s 降至 60.82s,减少 32.9%(1.49 倍加速)。
- SageAttention2:耗时从 57.96s 降至 40.26s,减少 30.5%(1.44 倍加速)。
该节点提供 Safe、Fast 和 Aggressive 预设模式。这是一种近似优化而非无损优化,即使使用相同种子,精确的运动轨迹也可能发生变化。该实现无需额外的 Python 包或自定义 CUDA 内核,已在 GitHub 上以 MIT 许可证开源。
「Infra」频道最新
- 马斯克畅想TeraFab算力分配:四分之一供Optimus机器人 — XFreeze · 2026-08-07
- 开源项目探索:基于 WASM/JS 的浏览器去中心化 AI 算力网络 — NoiseyGameYT · 2026-08-07
- dadabots实现笔记本零成本无限生成式音乐直播 — affige_yang · 2026-08-07
- Cloudflare公开Kimi和GLM规模化推理优化:KV缓存量化与权重压缩 — JeremyCMorgan · 2026-08-07
- Neon推出对象存储分支功能,数据库与文件可无重复存储分支 — matei_zaharia · 2026-08-07
- RTX 5090笔记本如何本地部署FLUX?Reddit网友求推荐 — RutabagaSad8257 · 2026-08-07