SGLang 把 Qwen3.8-27B 变决策模型,百毫秒内通关宝可梦火红

zhaoran_wang · x · 2026-09-30

SGLang 团队将 Qwen3.8-27B 改造成多模态决策模型,从实时游戏画面出发,以低于 100 毫秒的决策延迟打通了《宝可梦火红》的四天王与冠军。

工程层面:SGLang 新增原生 /v1/decisions 接口,可以把 LLM 和 VLM 当作分类与打分模型来用;另外加了 /v1/systemone,让 Jev 类开源模型可配合 TypeSafe SDK 使用。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →