incoai 推出 Qwen3.8-27B-DFlash2 草稿模型,主打投机解码加速
incoai · hf · 2026-08-20
incoai 发布 Qwen3.8-27B-DFlash2,基于 block-diffusion 的 DFlash2 草稿(draft)模型,用于投机解码加速推理,兼容 SGLang 和 vLLM,正登上 Hugging Face 热门趋势。
所属事件:Qwen3.8-27B DFlash2 草稿模型用块扩散加速推理(2 条相关)→
「模型」频道最新
- Gemini 3.7 Flash 惊艳解决复杂网络配置难题 — DynamicWebPaige · 2026-08-20
- Qwen3.8-27B 实测:KV Cache 量化至 Q4 显著影响思维质量 — fbms2 · 2026-08-20
- GPT-5.6 推理时学会联网查找信息 — dejavucoder · 2026-08-20
- DeepSeek V4 Flash 0731 定价与参数公布 — AccBalanced · 2026-08-20
- Superwhisper 发布 S1-mini:0.6B 参数 STU 文本规范化模型 — Recoil42 · 2026-08-20
- 智谱 GLM 5.3 交互演示:纯指令驱动即可执行任务 — BLUECOW009 · 2026-08-20