Qwen3.8-27B 推出 GGUF 格式,集成推测解码加速
z-lab · hf · 2026-08-23
z-lab 在 Hugging Face 发布了 Qwen3.8-27B 的 GGUF 量化版本。该模型基于 Qwen/Qwen3.8-27B,集成了 DFlash2 技术和推测解码(speculative-decoding)方案,旨在通过使用草稿模型(draft-model)来提升推理速度,兼容 llama.cpp 生态。
所属事件:Qwen3.8-27B 量化版集成推测解码加速推理(2 条相关)→
「模型」频道最新
- 点评 ox 模型:像博士级勤务员的谨慎子智能体 — teortaxesTex · 2026-08-23
- MiniMax H3 提示词服从度太高,导致视频缺乏生动细节 — DifficultAd5938 · 2026-08-23
- 普林斯顿 i1 模型:全开源文生图方案与 300 组实验 — 机器之心 · 2026-08-23
- AI 生成文本现“费布利什”怪象:否定词错乱与宾主倒装 — alexisgallagher · 2026-08-23
- 实测:Terra 胜过 Sonnet,Flash 速度质量无敌 — cgarciae88 · 2026-08-23
- 用户报告 Gemini 答非所问:代码问题换来澳洲税号科普 — mic_n · 2026-08-23