GMI Router 实测:三类任务自动分派三家模型,单次省 0.02-0.03 美元
Shruti_0810 · x · 2026-08-28
用户给 GMI Cloud Router 同一会话下了三类不同任务:销售趋势分析、API/缓存数学题、JS 性能 bug,Balanced 模式下路由器把请求分别分给了 Qwen3.7-Max、GPT-5.6-Luna 和 DeepSeek-V4-Flash,而非全部发给一个前沿模型。
路由池共 21 个可选模型,按任务、质量目标与成本逐请求选择。相比默认跑 Claude Opus 4.8,每个 prompt 约省 0.02-0.03 美元,规模化后差异可观。用户可选择优化目标:Quality(先保质量再选最便宜)、Balanced(质量/成本平衡)、Cost(最小化开销),且每个请求都能看到所选模型与路由元数据。
「Infra」频道最新
- 存储业务的“年龄回报率”:旧数据如何补贴新数据 — surmenok · 2026-08-28
- 3D 渲染优化挑战结果出炉,提速 2.4 倍 — janusch_patas · 2026-08-28
- 美拟推芯片安全法案:要求高端 AI 芯片定位 — peterwildeford · 2026-08-28
- AI 芯片设计公司 RicursiveAI 获生产级验证 — Azaliamirh · 2026-08-28
- MiniMax-H3 跑 8×H200:无损加速 1.95 倍,最高 6.24 倍 — ying11231 · 2026-08-28
- Architect Labs 称 AI 两周设计出芯片 Redwood,能效比号称超 NVIDIA — mark_k · 2026-08-28