8GB 的 4060 跑 34GB 模型:LTX2.5 本地生 10 秒视频仅 40 分钟
BigBullshitta · reddit · 2026-09-17
一位.reddit 用户分享了自己回归本地 AI 生图/生视频的体验,感叹一年半来本地推理技术的飞跃:
- 硬件仅 4060 8GB + 32GB 内存,过去用 ZImageTurbo 生一张图要约 1 分钟,SDXL 约 15 秒,视频生成完全不敢想。
- 本周用 Wan2GP + ComfyUI 跑 Krea2(Klein 2 9B)int8-convrot 量化版(13GB):单张 1.2MP 图从约 1 分钟降到 20-30 秒,且大模型不再出现显存换入换出导致的 GPU 空转。
- 用 LTX2.5 做图生视频:768x1024、10 秒、24fps 在「热个饭的工夫」就出片且质量出色。
- 最震撼的一次:无意中用 1280x1280 的 latent 分辨率跑了 40 分钟,GPU 全程 98-100% 利用率,最终生成相当于 240 张 1.6MP 图像的素材——模型栈总重达 34GB。
作者归功于近一年 tensor core / convrot / sage 等量化与显存调度技术的进步,让消费级显卡也能跑远超显存的大模型。
「Infra」频道最新
- 本地推理慢?推测解码用小模型起草、大模型批量验证 — HowDevelop · 2026-09-17
- 印度拟投约 300 亿美元建设本土半导体产业 — Polymarket · 2026-09-17
- 受 AgentConf 演讲启发,开发者计划在家用 Blackwell GPU 本地跑 Agent — TejasKumar_ · 2026-09-17
- 深度解析 DeepSeek-V4.1 Flash:把 KV Cache 压缩推到极限 — teortaxesTex · 2026-09-17
- 四项调度技术压平 MoE 长上下文训练内存峰值,1M 上下文吞吐提升 10 倍 — Shrey Pandit · 2026-09-17
- 两周上线:GLM 智能体自建推理基建,端到端吞吐提升 3.2 倍 — jietang · 2026-09-17