Ramp 开放 LLM 路由器,称已将 AI 成本降 30% 以上
iamrobotbear · x · 2026-07-21
Ramp 正在把内部 LLM 路由系统 Ramp Router 向外开放:用户只接一个兼容 OpenAI 的入口,系统会把每个请求分配给“足够好但最便宜”的模型。
- 新模型会先在真实工作负载上做测试,再决定是否放量。
- 路由之外,系统还会判断何时缓存、批处理,何时升级到更强模型。
- 官方称,这套方案已经让成本下降了 30%+,而输出质量保持不变甚至更好。
- 其 alpha 组规模据称已达到 2.75T tokens/月,并保持 99.99% uptime。
这条帖子的核心观点是:在 GPT、Claude、Gemini、Grok、Qwen、DeepSeek、Kimi、GLM 等模型能力和价格每周都在变化的情况下,模型路由本身正在变成一项关键基础设施能力。
所属事件:Ramp 开放内部多模型路由器 Ramp Router(11 条相关)→
「Infra」频道最新
- NVIDIA 称 Blackwell Ultra 训 DeepSeek-V3 达每 GPU 1648 TFLOPs — NVIDIAAI · 2026-07-21
- NVIDIA 重申 Blackwell Ultra 训 DeepSeek-V3 吞吐纪录 — NVIDIAAI · 2026-07-21
- 购物应用把 OpenTelemetry、Dynatrace 和 Port 串成 Agent 排障流 — Pavan_Belagatti · 2026-07-21
- Nvidia Rubin 即将登场,指向下一代 AI 算力平台 — ezyang · 2026-07-21
- Tesla FSD v14 Lite 预计推向 400 万辆旧 HW3 车 — MatthewBerman · 2026-07-21
- 台积电 3nm 利用率据称超 120%,AI 需求推高 1900 亿美元资本开支 — tengyanAI · 2026-07-21