ComfyUI 节点:混合加载 Minimax H3 模型提升视频质量

ThatsALovelyShirt · reddit · 2026-08-11

开发者发现 Minimax H3 的 ref2va 模型在音视频质量上不如 fl2va,尽管两者架构相同。

通过对比,差异主要集中在 .adalnproj. 张量上。为此,作者开发了一个自定义的 ComfyUI 模型加载节点,可在加载时选择性地将 ref2va 的部分张量叠加到 fl2va 基础模型上,且无额外显存开销。实验表明,仅叠加 30-49 块的张量,就能在保持 fl2va 高质量的同时赋予其良好的参考理解能力。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →