Together AI推出Qwen3.8-2.4T-A95B无服务器推理,支持高吞吐编码与Agent负载

togethercompute · x · 2026-08-13

Together AI宣布其Serverless Inference服务为Qwen3.8-2.4T-A95B提供托管高吞吐路径,适用于编码和Agent工作负载。模型支持256K上下文、128K输出,推理努力可调,并提供99.9% SLA。

所属事件:Together AI推出Qwen3.8-2.4T-A95B无服务器推理服务(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →