Together AI推出Qwen3.8-2.4T-A95B无服务器推理服务
Together AI 宣布其 Serverless Inference 服务已为 Qwen3.8-2.4T-A95B 模型提供托管高吞吐路径,专为应对高强度的编码与 Agent 工作负载而设计。该模型具备 256K 超长上下文,能够轻松处理大型代码库。此外,它还支持任务状态调度与恢复,并具备跨构建、单元测试及函数调用等长程 Agent 工作流优势。
2026-08-13 ~ 2026-08-13 · 2 条相关
- 第 1 集:阿里开源2.4T参数旗舰Qwen3.8-Max(2026-08-12,17 条)
- 第 2 集:vLLM首发支持通义Qwen3.8 2.4T大模型(2026-08-13,2 条)
- 第 3 集:Together AI推出Qwen3.8-2.4T-A95B无服务器推理服务(2026-08-13,2 条)
- Qwen3.8-2.4T-A95B长程Agent特性:256K上下文、自测与函数调用 — togethercompute · 2026-08-13
- Together AI推出Qwen3.8-2.4T-A95B无服务器推理,支持高吞吐编码与Agent负载 — togethercompute · 2026-08-13