AMD 显卡 ComfyUI 提速实战:图生视频从 28 分钟压到 3 分钟
Sweetest_Jesus · reddit · 2026-10-11
作者基于 Radeon AI PRO R9700(32GB、680GB/s)实测,总结 ComfyUI 图像/视频工作流的提速方法:一个 minimax H3 图生视频工作流从 28 分钟降到 3 分钟,思路是先生成再 upscale。
流水线四阶段
- 文本编码器:把 prompt 转成 embeddings,每个 prompt 只跑一次,且 embeddings 可保存复用。
- 噪声 latent:由 seed 决定初始噪声。
- 扩散模型:每步去噪,早期步骤定构图/运动,后期加细节。
- VAE 解码:latent 转像素。
显存优先
- 权重占约 60-70% VRAM(32GB 卡约 19-22GB);14B 视频模型 fp16 约 28GB、fp8 约 14GB。
- 溢出到系统 RAM 的代价比任何设置都大;控制台出现 "loaded partially" 就是超预算,"loaded completely" 才是理想状态。
- 可把文本编码器放 CPU 或第二块 GPU,把调好的 embeddings 存下来避免重复编码。
- Wan 2.2 这类双模型设计每次运行需一次模型交换;minimax 无需双模型但单模型更大。
速度由分辨率、帧数、步数主导
- 模型装进显存后,大小影响远小于分辨率×帧数×pass 数;宽高翻倍意味着 patch 数 4 倍、attention 计算约 16 倍。
- 建议:先用低分辨率验证 prompt 和 LoRA,再放大到目标分辨率。
「Infra」频道最新
- Extropic 创始人:每天全投入 14 小时冲刺大里程碑 — beffjezos · 2026-10-11
- 长 MCIO 线缆信号衰减怎么办:retimer 能帮信号回弹 — TheZachMueller · 2026-10-11
- 主板直连 switchboard 撑不起 PCIe 槽位,适配器多用非 slimSAS — TheZachMueller · 2026-10-11
- Cloudflare:AI 爬虫拦截率一年翻倍至 13.47% — YvesMulkers · 2026-10-11
- 玩家自调 vLLM 构建:单卡 R9700 跑长上下文多智能体 — KriptacMessage · 2026-10-11
- 爆料:Anthropic 借 SpaceX 算力放宽用量,OpenAI 却算力吃紧 — mark_k · 2026-10-11