RTX3090 上 2.5 分钟出片:FL2V+H3 引导生成工作流实测

VisionWithin · reddit · 2026-08-27

作者尝试用 ComfyUI 的 FL2V 节点搭配「Add Guide for Minimax H3」节点做无缝衔接的动作场景:只要 1 秒引导视频就能产出视觉上连贯的体验,但音频不可行,只能后期配音、用画面和提示词引导音频生成。

制作全程用 16:9 480p 视频 + 8-step turbo LoRA,在 RTX3090 上单次生成约 2.5 分钟,失败镜头可以快速重跑和改进提示词。缺点是主体一致性基本靠运气,更严肃的测试需要用 Ref2V 节点做引导式生成来提升。整体结论:很好玩。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →