Together AI推出Qwen3.8-2.4T-A95B无服务器推理,支持高吞吐编码与Agent负载
togethercompute · x · 2026-08-13
Together AI宣布其Serverless Inference服务为Qwen3.8-2.4T-A95B提供托管高吞吐路径,适用于编码和Agent工作负载。模型支持256K上下文、128K输出,推理努力可调,并提供99.9% SLA。
所属事件:Together AI推出Qwen3.8-2.4T-A95B无服务器推理服务(2 条相关)→
「Infra」频道最新
- 跨提供商推测性解码遇阻:长上下文致接受率断崖式下跌 — hoyasgirl25 · 2026-08-13
- 为什么太空是 AI 数据中心极差的散热场所? — CackleRooster · 2026-08-13
- 德州将拥 10GW 电力,核能成地表算力终极解 — NinaDSchick · 2026-08-13
- CoreWeave警告:摆脱英伟达芯片依赖需时间和资金 — dinabass · 2026-08-13
- AI云厂商Lambda完成9.26亿美元巨额贷款,获机构级信用评级 — TheZachMueller · 2026-08-13
- 可信执行环境(TEE)推理暗坑:5%的结构化输出错误率 — bgmshana · 2026-08-13