Qwen3.8-27B开源:RTX 5090上解码速度达206 tok/s,SGLang Day-0支持
cedric_chee · x · 2026-08-15
阿里通义千问开源Qwen3.8-27B模型,SGLang团队提供Day-0支持。在单张RTX 5090上,通过NVFP4和DSpark技术,解码速度达到206.1 tok/s;在DGX Spark上为38.28 tok/s。该模型在智能体规划和长程任务上表现出色,被称为“小模型之王”。
所属事件:Qwen3.8-27B开源发布,登顶HF趋势榜(36 条相关)→
「模型」频道最新
- Qwen2.5-72B 性能领跑同级模型 — solyarisoftware · 2026-08-15
- Harvey 联手 Applied Compute 训练法律专用模型,成本延迟远低于前沿模型 — rhythmrg · 2026-08-15
- 首个医疗三元模型Pestle 27B发布,Apache 2.0开源 — Individual-Dot5488 · 2026-08-15
- 前沿模型全面降价,开源闭源齐降,智能体成本更优 — markjeffrey · 2026-08-15
- RedNote AI实验室新RL方法TEMPO:16B模型ARC-AGI 3得分超30% — GregKamradt · 2026-08-15
- Orion-16B突破100B训练token,采用去中心化算力 — const_reborn · 2026-08-15