MiniMax H3 首日实测:参考图拉满更能稳住人物和纹理
jozbgm · reddit · 2026-08-04
作者说自己拿到 MiniMax H3 的第一天,基本整天都在测试,并用一段旧的 Seedance 视频当基准,重新从头生成了一版。
这次测试怎么做的
- 用 H3 复刻了一段短片,保持相同角色和镜头节奏。
- 成片由多个 6 秒片段 拼成,合起来大约 42 秒。
- 环境是 ComfyUI、RTX 5090、96GB 内存,并使用了 minimaxh3ref2vaprunedint8convrot 这套流程。
目前看起来有效的做法
- 当脸和纹理必须稳定继承时,refimagesize: max 比尺寸匹配更好,虽然更慢。
- 在参考图权重高的提示词上,resmultistep + beta 调度器更稳。
- 声音最好按具体物理事件去描述,比如撞击、撕裂、呼吸,而不是只写情绪词。
- 每个片段都要重新明确角色身份,不能指望它自动连续。
还没验证的问题
- 单个片段里到底能放多少运动量。
- 长链条生成下角色身份能维持多久。
- 某些镜头更适合一次生成完成,还是后期拼接。
作者表示自己还在“优化曲线的第一小时”,欢迎别人分享更好的参数和提示词习惯。
所属事件:MiniMax H3 实测:多模态全链路创作与开源(12 条相关)→
「Infra」频道最新
- Databricks 年化收入突破 40 亿美元,累计融资接近 218 亿美元 — thedealdirector · 2026-08-04
- AI 指数在 2024 年末后陡增 5 倍,算力转向推理和后训练 — ProfBuehlerMIT · 2026-08-04
- DeepSeek V4 Flash 量化版本本地性能实测:Q3 比 Q8 快数倍 — Spicy_mch4ggis · 2026-08-04
- Bittensor 推出 Root Reborn,恢复验证者并取消自动抛压 — const_reborn · 2026-08-04
- ARPL 让 llama.cpp 按 ARM 指令集和核心拓扑运行时自适配 — OpeningTough145 · 2026-08-04
- DeepSeek V4 Flash 0731 在 llama.cpp speculative decoding 里报 ctx_other 错 — Ambitious_Fold_2874 · 2026-08-04