SGLang 宣布支持 Qwen3.8-Flash-Next 部署
Alibaba_Qwen · x · 2026-08-26
推理框架 SGLang 宣布对 Qwen3.8-Flash-Next 提供首发支持。用户现在即可在 SGLang 上部署该新架构模型。
「Infra」频道最新
- 阿里 Qwen3.8 搭配 51B N-gram 嵌入,现已支持 SGLang 部署 — Alibaba_Qwen · 2026-08-26
- 边缘节点难脱离超中心化基础模型 — curious_vii · 2026-08-26
- 预告:Apple MLX 本地模型运行新进展 — dscape · 2026-08-26
- Glean 实战:小模型组合拳节省 81% Token 成本 — _akhaliq · 2026-08-26
- Mac 跑 MiniMax H3 出 480p 视频 8 分钟:Turbo LoRA 提速工作流 — xNightWardenx · 2026-08-26
- 英伟达 Nemotron 助力受监管行业构建专用 263B 模型 — NVIDIA Developer · 2026-08-26