MiniMax H3 连帧生成实测:背景易糊,长镜头可降 3 倍损耗

DeliciousGorilla · reddit · 2026-08-06

用户使用 ComfyUI 本地部署 MiniMax H3 模型,测试了通过提取上一片段最后一帧作为下一片段首帧的方法来拼接长视频。结果发现,每次 VAE 编解码会导致约 2% 的高频细节损失,拼接 4-5 次后背景的刚性纹理(如墙面、配电盘)就会严重崩坏,但人脸因有模型先验知识维持得相对较好。

优化建议:

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →