Unsloth 发布 Qwen3.8-27B 新量化版:精度提升 10%
danielhanchen · reddit · 2026-08-20
Unsloth 发布了 Qwen3.8-27B 的 GGUF 新量化版本,采用 Dynamic v3.0 技术,在同等大小下精度提升 10%,在 Div-300、KLD 等基准测试中超越同类 10% 以上。此外还发布了保留 77% 精度的 1-bit 量化版本,可在 8GB RAM 上运行。该方案仅使用后训练量化,未使用 QAT/QAD 或在 imatrix 校准集上训练。官方还提供了详细的过拟合分析和 imatrix 文件供社区复现。同时 Unsloth Desktop 将迎来更新,支持自动压缩和外部 API 工具调用。
所属事件:Unsloth 新量化版 Qwen3.8-27B 同体积精度提升 10%(2 条相关)→
「Infra」频道最新
- AI 耗电 10 倍于搜索,算力扩张面临能源基建断供 — ingliguori · 2026-08-20
- Unsloth 发布 Qwen2.5-72B 新量化模型:1-bit 版仅需 8GB 显存 — cephaloform · 2026-08-20
- 对比 DGX B300 与 DGX Spark:去中心化训练可能更优 — aarthir · 2026-08-20
- DeepInfra 推出 Sandboxes: 为 AI 智能体提供安全隔离的算力 — gharik · 2026-08-20
- 16 万元 RTX Pro 6000 闲置换 M5 Max 128GB?本地推理选型讨论 — aghanims-scepter · 2026-08-20
- Cloudera 推出 Anywhere Cloud,改变企业 AI 部署 — DavidLinthicum · 2026-08-20