30B视频MoE模型量化版实测:多数人暂不建议折腾
EntireBig7258 · reddit · 2026-08-03
作者详细对比了 LingBot-Video 30B-A3B MoE 模型的几种主流社区量化方案及运行现状:
- GGUF 方案:磁盘占用约 17GB,通过将权重保留在系统内存并按需去量化,RTX 3070 的峰值 VRAM 可控制在 8GB 左右,但分辨率与帧数限制尚未明确。
- SDNQ uint4 方案:基准测试显示其 PSNR 仅为 13.56 dB,存在明显的偏色问题,画质损失严重。
- fp8 方案:目前仅支持 1.3B 模型,速度约为 bf16 的 1.27 倍。
- Diffusers 原生支持:FastVideo 提供了包含 refiner 的 1.3B 与 30B 端口,ComfyUI 也在推进原生支持。
结论:目前工具链仍在完善中,且 30B 量化版存在画质损耗。对于普通用户,建议暂缓尝试 30B 版本,直接在全精度下运行 1.3B 模型是更稳妥的选择。
「Infra」频道最新
- 为何 SQLite 架构将在 AI Agent 时代占据主导? — glcst · 2026-08-03
- SK海力士营收超台积电引热议:存储芯片繁荣背后的隐忧 — jwt0625 · 2026-08-03
- M3 Ultra 跑 DeepSeek V4 速度达 37 t/s — mishig25 · 2026-08-03
- Cloudflare 启动 Agents Week:打造面向 AI 智能体的专属云原生底座 — ritakozlov · 2026-08-03
- 开源视频模型部署避坑:商用授权与显存需求实测对比 — Mysterious_Sign_9501 · 2026-08-03
- AMD与Core Scientific签530MW AI数据中心协议,价值超140亿美元 — Beth_Kindig · 2026-08-03