Qwen3.8-27B 推理提速至 62 tok/s,去中心化优化显效

TheMoonMidas · x · 2026-08-18

推文展示了 Qwen3.8-27B 模型推理速度的优化成果,Token 生成速度从 26 tok/s 提升至 62 tok/s,并将其称为去中心化改进的成果。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →