用 qwen3-vl-4b + 提示指南自动改写 Minimax H3 分镜提示词
CountFloyd_ · reddit · 2026-09-04
作者在 ComfyUI 里用 Generate Text 节点搭配 qwen3vl4b CLIP 模型,把 Minimax 官方提示指南喂给模型,将简陋的基础提示词扩写成含多分镜的富提示词,效果超预期;但模型总是无视「单镜头不得超过 5 秒」的约束,分镜时长频繁超限,发帖求助是小模型能力不足还是提示写法问题。
「多模态」频道最新
- MiniMax H3 纯文本生成粗野主义风格 MV,视觉实验感十足 — Hailuo_AI · 2026-09-04
- AI 重制《终结者2》片段,复古科幻遇上生成视频 — alanskimp · 2026-09-04
- 破解 H3 无法出正面全身头像:头上画个「隐形光环」妙招 — robertwellesley · 2026-09-04
- 开发者重写内核:Reframe 渲染引擎比 Octane/Arnold 快约 48 倍 — D3VAUX · 2026-09-04
- AI 把博物馆展品「复活」成动画,网友晒创意视频 — FallingKnifeFilms · 2026-09-04
- Gemini 推出 Agentic Video:长视频理解省 88% token 还更准 — davidstutz92 · 2026-09-04