MiniMax H3 768x 唱歌口型半数翻车脸融化
PersonalityLimp2593 · reddit · 2026-09-02
用户在 Reddit 反馈:用 MiniMax H3 做 ref2ref 视频生成并做音频同步唱歌时,在 768x 分辨率下约一半概率出现「脸融化」伪影,疑似低分辨率像素被拉伸所致。楼主提问三个方向:参考图细节不足是否是主因;最新的 2k 3H 旗舰模型能否解决低分辨率问题(ChatGPT 认为不能);以及 ComfyUI-H3-FaceRefine 插件效果如何。因本机算力不足只能云端解决。
「多模态」频道最新
- Sprite Fusion 专攻像素风模型:20 秒生成 16x16 游戏素材 — HugoDuprez · 2026-09-02
- 赛博朋克外星黑帮选角视频引热议,疑为 AI 生成试镜片段 — LuckyFeelingPunk · 2026-09-02
- Seedance 2.5 渲染涩谷蜘蛛侠漫威联动短片,画面效果惊人 — heypearlai · 2026-09-02
- 用 Fable 5.1 + Blender 打造龙巢场景,工作进展演示 — majidmanzarpour · 2026-09-02
- 一份 ChatGPT 提示词:模拟 iPhone 16 Pro Max 光学特性生成超真实 AI 网红照 — EXM7777 · 2026-09-02
- Nano Banana 提示词把任意品牌 logo 变成逼真马卡龙商拍 — azed_ai · 2026-09-02