Qwen3.8-27B Ridge 量化版发布
alexcovo_eth · x · 2026-08-19
Qwen3.8-27B Ridge 是一个新的量化版本,保持了 27B 的智能水平,显存仅需 12GB,可在单张消费级 GPU 上运行。特点包括:
- 架构感知量化:GDN 状态保持 Q80 精度,避免通用 IQ2 的精度损失。
- 内置 MTP 推测解码:加速生成且零质量损失。
- 多模态支持:配合 mmproj 可处理图片(绘画、路标等)。
- 实测表现:成功运行了马克·吐温风格写作、树动画和 80 种语言测试,全部在本地单卡完成。
「Infra」频道最新
- Hugging Face 更新文档:如何打包 Triton 自动调优配置 — RisingSayak · 2026-08-19
- 新论文:嵌套式模型套件训练,算力成本大幅降低 — yoavartzi · 2026-08-19
- Liquid 释出 QAD 量化模型,4-bit 精度达 97% — helloiamleonie · 2026-08-19
- LoRA 训练实测:梯度累积并非时间零和游戏 — traceml-ai · 2026-08-19
- CXL 标准落地在即,Marvell 与 Google 受益 — BenBajarin · 2026-08-19
- LLM 中期训练指南:数据配比与防过拟合策略 — cwolferesearch · 2026-08-19