Minimax H3 图生视频多镜头提示词实践与耗时测试

call-lee-free · reddit · 2026-08-19

作者分享了使用 Minimax H3 进行图生视频(Image-to-Video)的详细测试。通过设计包含时间码和对话的多镜头提示词,成功生成了一段约 30 秒的连续对话视频。文中展示了完整的 Prompt 结构,包括场景描述、人物台词(指定英式口音)及镜头切换时间点。作者提到当前受限于硬件显存(RTX 4070 Super),仅能渲染 0.4MP 低分辨率,耗时 173 分钟,并寻求更高分辨率渲染的优化建议。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →