Wan2.2 的 INT8 Convrot 在 3090Ti 上反而更慢
Fun-Class3451 · reddit · 2026-07-24
有用户在 ComfyUI 里实测发现,Wan2.2 的 INT8 Convrot 在 3090Ti 上并没有比 Q8 GGUF 更快,哪怕已经升级到支持 CUDA 12.8 的新版。
- 两边都用了 SageAttention 和 lightx2v,生成 101 帧
- Q8 GGUF:总耗时约 120 秒,高/低两次分别是 24.72 s/it、22.34 s/it
- INT8 Convrot:总耗时约 139 秒,高/低两次分别是 28.88 s/it、28.71 s/it
- 发帖人困惑的是:按理说 INT8 Convrot 在 Ampere 卡上应该更快,为什么实测反而更慢
「多模态」频道最新
- 北大开源 K12-KGraph:面向教育 LLM 的 2.36 万题基准 — PekingUniversity · 2026-07-24
- 疑似新 Opus 一次生成出高细节 voxel 寺塔 — cedric_chee · 2026-07-24
- Swiss AI 发布 Apertus v1.5 开放多模态模型 — jacek2023 · 2026-07-24
- 有人开始用 Claude Code 直接生成 ComfyUI 工作流 — My-NameWasTaken · 2026-07-24
- 微软发布 VibeVoice-ASR-BitNet:一款多语种语音识别模型 — microsoft · 2026-07-24
- Midjourney 把清晨场景做成了杂志感人像 — tisch_eins · 2026-07-24