RTX 5080 对比 5060 Ti 实测 FLUX Krea 2:速度快约 2.1 倍,LoRA 代价极不对称
Altruistic_Print717 · reddit · 2026-10-06
作者用同一台机器(Ryzen 7 5700X、32GB 内存)在 ComfyUI 中实测 RTX 5080 与 RTX 5060 Ti 16GB 跑 FLUX Krea 2 的出图速度,覆盖 1–4 MP、两种采样器(euler/beta 与 gauss-legendre2s/normal)、有无 LoRA,以及 SeedVR ×2 放大。
关键结论:
- 5080 整体快约 2.1–2.2 倍:1 MP euler 无 LoRA 时 9 秒 vs 16 秒(0.89 vs 0.50 it/s);4 MP 时 39 秒 vs 86 秒。
- LoRA 惩罚极不对称:5080 在 1 MP 时加 LoRA 慢 +56%(9→14 秒),而 5060 Ti 只 +6%(16→17 秒);到 4 MP 两者都收敛到约 +13%。
- 采样器成本远大于 GPU 成本:gauss-legendre2s 比 euler/beta 慢约 2.9–3.2 倍,且两张卡都如此。
- SeedVR ×2 放大在 4 MP 时占主导:5080 上额外 +157 秒(占总时长 78%),5060 Ti 上 +210 秒(占 70%);1–3 MP 时只增加约 23–37 秒。
- 一个异常:1 MP + gl2s + 1 LoRA 时 5060 Ti 反而比 5080 快(53 vs 58 秒),疑似测量噪声或首跑缓存。
作者附上了全部配置的 s/it 与 it/s 完整数据图。
「Infra」频道最新
- 单卡 RTX PRO 4500 32GB 跑 188k 上下文,推理速度达 60-67 tok/s — sdfprwggv · 2026-10-06
- 五大云厂商 AI 资本开支明年将激增92%至7890亿美元 — luisdans · 2026-10-06
- PyTorch 大会官宣:IBM 将讲 Spyre 加速器与分布式推理进展 — PyTorch · 2026-10-06
- llama.cpp v0.6.0 发布:Qwen4Exp 支持 MTP 投机解码 — vexatious-big · 2026-10-06
- 维基媒体基金会证实发现 OpenAI「失控」Agent 活动痕迹 — dejavucoder · 2026-10-06
- 深度访谈 NVIDIA Nemotron 3 Ultra:为何「更快的模型就是更聪明的模型」 — yacinelearning · 2026-10-06