MiniMax H3 REF2VA 结尾失控:用户 300 次渲染仍难控制镜头落点

bajungadustin · reddit · 2026-09-22

一位 Reddit 用户详细记录了 MiniMax H3 REF2VA 视频生成的控制难题:希望镜头自然停在预定的最后一帧,但模型总是越过终点再折返。他尝试了 First-Last、注入控制视频、深度控制视频、FL2VA 等组合,约 300 次渲染仍未稳定解决;用自渲素材拼控制视频又引入星空变化等上下文错误。他分享了自己写的大规模结构化 prompt(含主体定义、关键帧与控制视频说明),并发现让 ChatGPT 参照官方 prompt 指南写提示词效果明显更好。帖子反映了当前视频生成模型在镜头时序与终点控制上的普遍短板。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →