单图生成30秒视频:MiniMax H3本地实测与提示词拆解
Tight_Organization54 · reddit · 2026-08-07
一位开发者成功使用 MiniMax H3 模型,仅凭一张约翰· Wick 的静态图片,在本地生成了长达 30 秒的连贯视频。
- 硬件与参数:在 RTX 4070 Ti Super (16GB VRAM) 和 32GB 内存的配置下,单段视频生成耗时约 6 分钟。使用了 6 步生成、0.4 MP 分辨率,并加载了 Turbo LoRA 来加速。
- 工作流:作者放弃了容易导致画面撕裂的 RTX 放大方案,直接使用 ComfyUI 内置的 Ref2V 工作流。
- 提示词工程:作者借助 Grok 自动生成了结构化的长提示词,详细规划了主角在 30 秒内的 6 个连贯动作(起床、喝咖啡、踢球、射击、刷牙、睡觉),并成功保持了角色外观的高度一致性。
所属事件:开发者实测MiniMax H3:单图本地生成30秒视频(2 条相关)→
「多模态」频道最新
- 视频模型 Seedance 2.5 上线 fal,支持空间电梯视角运镜 — aziz4ai · 2026-08-07
- AI 将《进击的巨人》角色带入现实,莱纳神还原抢镜 — eyishazyer · 2026-08-07
- 字节 Seedance 2.5 企业级 API 上线,支持 30 秒长视频 — alifcoder · 2026-08-07
- Seedance 2.5 实测:支持 30 秒直出与音频驱动,失败生成不扣费 — Fun_Walk_4965 · 2026-08-07
- 可灵 2.5 实测:上传 23 张 PPT 直接生成同主题 MG 动画 — ring_hyacinth · 2026-08-07
- 无需重训练!VChain 用视觉思维链修复视频生成物理逻辑 — ziqi_huang_ · 2026-08-07