Qwen3.8-27B 推理提速至 62 tok/s,去中心化优化显效
TheMoonMidas · x · 2026-08-18
推文展示了 Qwen3.8-27B 模型推理速度的优化成果,Token 生成速度从 26 tok/s 提升至 62 tok/s,并将其称为去中心化改进的成果。
「模型」频道最新
- 要证明水印不伤模型能力,就该公开水印细节让人自测 — 1a3orn · 2026-08-18
- Kimi K3 如何稳定训练高稀疏 MoE:Stable LatentMoE — jbhuang0604 · 2026-08-18
- Ollama 测评:DeepSeek V4 Flash 性能最佳,Qwen 质优但慢 30 倍 — ollama · 2026-08-18
- 传 OpenAI 本周发布代号 Astra 的新模型 — mark_k · 2026-08-18
- Qwen 27B F16 版本运行实测与显存需求 — Blues520 · 2026-08-18
- M2 Ultra 运行 Qwen3.8-27B 速度基准测试实录 — planetearth80 · 2026-08-18