MiniMax H3 Ref2V 实操踩坑:3 秒视频生成 15 分钟且音频丢失
yeah280 · reddit · 2026-09-07
一位用户在 ComfyUI 中尝试 MiniMax H3 的 Ref2V 功能做角色/背景替换:输入 3 秒原视频加原音频,用 refvideo0、refaudio0 节点接入,prompt 要求保留原动作、运镜、时序和音频并去除字幕,20 步、24FPS 输出。实测遇到三个问题:原音频未被正确保留、3 秒视频生成耗时约 15 分钟、输出时长与源视频不匹配。作者附上 workflow JSON 求助连接方式是否有误,评论可作 H3 实际能力的参考。
「多模态」频道最新
- 像素精灵还能动起来:网友用 Sprite Fusion 给 AI 生成图加动画 — HugoDuprez · 2026-09-07
- 实测 Grok、ChatGPT、Gemini 全军覆没:AI 拼不出一组书封拼贴 — pickover · 2026-09-07
- 日本设计师承认:GPT-6 Astra 实操 Figma 做页面设计,「几乎赢不了」 — deedydas · 2026-09-07
- 用 GPT-6 Astra 把梵高星空变成可漫游 3D 世界 — emmanuelvivier · 2026-09-07
- GPT-6 Astra 3D 建模演示:可推理几何并迭代修正 — Cklly2004 · 2026-09-07
- 用 Seedance 与 GPT Image 打造短片:当 AI 成为情感顾问 — HashemGhaili · 2026-09-07