12GB显卡本地跑MiniMax H3做电影预告片:0.6MP+4:3是甜点
vortis23 · reddit · 2026-10-06
Reddit 网友尝试在 12GB 显卡上用 ComfyUI 跑 MiniMax H3 的 30 秒 Ref2V 工作流,目标是本地生成连贯稳定的电影预告片。角色与环境参考模型先用 Akool 生成。
核心结论:
- 12GB 显卡在 16:9 下只能跑 0.3-0.4 兆像素,超过就严重畸变和幻觉;高质量需要 0.5-0.6 兆像素 + 25-30 步,但 12GB 卡会崩溃或单次生成超一小时
- 甜点区是 0.6 兆像素 + 4:3 或 3:2 比例,角色细节、一致性和提示词遵循都够好,平均生成 19-21 分钟;复杂 30 秒片段约 1 小时 5 分钟
- 音频是难点:角色常在台词上卡壳,大量生成因音频瑕疵报废
- 精细的提示词 + 调度 + 步数下,MiniMax H3 可以媲美 Seedance 2/2.5,但对提示词精度和硬件要求极高
「Infra」频道最新
- XFreeze:未来 1-3 年 HBM 存储优势将决定超级智能竞赛 — XFreeze · 2026-10-06
- 69.1 万 H100 小时:从零训练检查点算力估算引算力门槛讨论 — teortaxesTex · 2026-10-06
- 开发者实测:Clef-Flash 在 Jetson Orin 本地推理也很流畅 — gregmushen · 2026-10-06
- 把 llama.cpp 编译成 WASM:纯浏览器端跑 LLM 的概念验证 — Numerous-Fan8138 · 2026-10-06
- Llama.wasm 开源:llama.cpp 编译 WASM+WebGPU,浏览器本地跑 LLM — Numerous-Fan8138 · 2026-10-06
- 英伟达 Dynamo 支持把编码智能体直连自托管端点,内置追踪回放 — TheZachMueller · 2026-10-06