Qwen3.8-Max登陆DigitalOcean Serverless,支持1M上下文
Alibaba_Qwen · x · 2026-08-14
阿里云Qwen3.8-Max(2.4T参数,95B激活)现已通过DigitalOcean Serverless Inference提供,基于NVIDIA HGX B300 GPU,支持1M上下文,专为长时编码任务设计。采用按用量计费,无需管理基础设施。
「模型」频道最新
- Qwen3.8-27B-FP8在GH200上实现10路并发流式推理,首包延迟10ms — MaziyarPanahi · 2026-08-15
- 阿里开源Qwen3.8-27B:27B参数媲美Opus 4.6,可本地运行 — haider1 · 2026-08-15
- Qwen3.8-27B开源:RTX 5090上解码速度达206 tok/s,SGLang Day-0支持 — cedric_chee · 2026-08-15
- Opus 4.6 Max可本地运行,全球科研能力将普及 — rand_longevity · 2026-08-15
- Hugging Face 报告:小模型主导实际使用,Qwen领跑本地推理 — huggingface · 2026-08-15
- Qwen3.8-27B社区反馈:内存占用、速度与创作能力待测 — pmttyji · 2026-08-15