社区发布 Qwen3.8 Flash 量化版:省 20-30GB 内存磁盘,质量持平 unsloth
Dutchnamn · reddit · 2026-08-29
Reddit 用户经多天测试发布了一套 Qwen3.8 Flash(Next)GGUF 量化文件,在质量相当的前提下比 unsloth、AesSedai 的同类量化少占约 20-30GB 磁盘和内存。readme 中公布了 PPL 数据,Q4 两档表现尤佳,Q3/Q5 后续跟进;采用 imatrix 与自研调优的量化配方。另为 AMD 用户提供了 ROCmFP4 专用量化,速度和质量略优于 Q4XS。
「Infra」频道最新
- Scobleizer:Qwen Cloud 原生构建 AI,集成更优 — Scobleizer · 2026-08-29
- NVL72实测AgentX吞吐量能效比竞品高30倍 — nvidia · 2026-08-29
- a16z 合伙人:全美仅 2% 电工持有直流电认证 — GregCook2011 · 2026-08-29
- GPU 集群中最「无聊」的网络能救命:带外管理详解 — AccBalanced · 2026-08-29
- 实测 STM32 与 ESP32 运行通用机器人控制策略 — yacineMTB · 2026-08-29
- 隐私架构构建信任:用户愿向 AI 敞开心扉 — bgmshana · 2026-08-29