640 次请求实测:LLM 路由省 33.2%,但固定中端模型更省 72.9%

smakosh · reddit · 2026-09-26

LLM Gateway 团队自评其基于 Jev 的模型路由功能,与固定模型基线对比(利益相关声明:路由由他们自己构建):

博客附完整 prompt、响应、归一化成本与可复现脚本。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →