H3 模型实测:ref2va 氛围感强但画质弱于 fl2va

Animystix · reddit · 2026-08-25

作者在显存受限的环境下对比了 H3 模型的不同版本(int8 修剪,4步)。发现 ref2va 在感受歌曲氛围和视频同步精度上表现出惊人的直觉,非常适合制作音乐视频,但在动作质量上明显不如 fl2va。测试了社区发现的"折中"方案:LoRA 权重更接近 ref 风格,混合权重更接近 fl 风格。作者倾向于使用 LoRA 以享受模型的创造力,而在追求视觉保真度时选择 fl。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →