Together推出前沿模型预留推理容量服务
Together Compute推出了一项名为Provisioned Throughput的新型无服务器产品,专为前沿开源模型提供预留推理容量。该服务采用按token计费模式,并承诺提供99%的可用性服务级别协议(SLA)以及有保障的TPM吞吐量。此举旨在满足任务关键型应用对推理稳定性的高需求。
2026-07-08 ~ 2026-07-09 · 2 条相关
- Together 推出预留推理容量 — togethercompute · 2026-07-08
- Together推保底吞吐服务 — togethercompute · 2026-07-09