Qwen 3.8 27B 上线 Cerebras,推理速度达 1500 tokens/秒

altertable · hn · 2026-09-04

阿里 Qwen 3.8 27B 模型已可在 Cerebras 推理平台上使用,官方文档标注推理速度高达 1500 tokens/秒,适合对延迟敏感的 agent 与编码场景。开源中型模型 + 超快推理的组合进一步降低了低成本高吞吐部署的门槛。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →