Qwen3.8-27B 推出 DFlash2 投机解码 GGUF 量化版
incoai · hf · 2026-08-22
Hugging Face 用户 incoai 发布 Qwen3.8-27B-DFlash2-GGUF 并登上趋势榜。该版本基于 Qwen/Qwen3.8-27B 量化,主打 DFlash2 draft model + speculative decoding(投机解码),适配 llama.cpp 本地推理,可在消费级硬件上加速大模型文本生成。Apache-2.0 许可。
「Infra」频道最新
- Gisting 技术:压缩 Prompt Token 可在保持行为下降低 75% 成本 — morgymcg · 2026-08-22
- Ramp 发布 Router 网关:宣称可平均降低 40% 推理成本 — round · 2026-08-22
- MCP 并非取代 API,而是改变了 API 的设计受众 — kush_patil · 2026-08-22
- 民调:美国民众反对建数据中心比例一年内升至 75% — The Decoder · 2026-08-22
- Woolly 让 Qwen3-8B 数理解码提速 2-3 倍 — bosmeny · 2026-08-22
- 观点:禁数据中心将致未来二十年经济低迷 — GabGarrett · 2026-08-22