Wan2.2 的 INT8 Convrot 在 3090Ti 上反而更慢
Fun-Class3451 · reddit · 2026-07-24
有用户在 ComfyUI 里实测发现,Wan2.2 的 INT8 Convrot 在 3090Ti 上并没有比 Q8 GGUF 更快,哪怕已经升级到支持 CUDA 12.8 的新版。
- 两边都用了 SageAttention 和 lightx2v,生成 101 帧
- Q8 GGUF:总耗时约 120 秒,高/低两次分别是 24.72 s/it、22.34 s/it
- INT8 Convrot:总耗时约 139 秒,高/低两次分别是 28.88 s/it、28.71 s/it
- 发帖人困惑的是:按理说 INT8 Convrot 在 Ampere 卡上应该更快,为什么实测反而更慢
「多模态」频道最新
- 用 MiniMax H3 MAX 对一只蚊子放大招,蚊子毫发无伤 — Hailuo_AI · 2026-09-11
- Skyfall GS 登场:用 Flux 提升 Gaussian Splatting 精修质量 — ducha_aiki · 2026-09-11
- AI 电影节 Lumara 将登陆纽约,顶级 AI 电影人齐聚评审 — 0xAllen_ · 2026-09-11
- 翼龙侦探:全程 AI 生成的概念片先导预告亮相 — PterodactylDetective · 2026-09-11
- Imperium 游戏预告片曝光,AI 视频生成再秀肌肉 — keaslenyt · 2026-09-11
- FLUX.2 Klein 换表情易丢脸,实测不如免费版 Gemini 保真 — wacomlover · 2026-09-11