一个 API 集齐模型能力评分、任务成本与推理缓存价格
airesearch12 · x · 2026-09-18
作者推荐了一个用于构建模型路由器的数据源 API,称其为目前独一无二的整合方案。该 API 提供四类关键数据:
- 各模型的清单列表
- 按主题的能力评分(capability score per topic)
- 每类任务的实际成本
- 各推理服务商的缓存价格
作者认为没有其他地方能在一个 API 里同时提供这些数据,适合需要按任务/主题智能分流请求到不同模型的开发者直接拿来实现路由逻辑。
所属事件:Benchmark Heaven 开源上线:百项基准、800 模型按真实任务成本对比(9 条相关)→
「编程与Agent」频道最新
- Polyphonic 上线:Mac 一窗管理 Claude Code、Codex 等多 Agent — RileyRalmuto · 2026-09-18
- 开发者曝 Codex 安全加固后改单条消息实例,破坏 agent 记忆连续性 — RileyRalmuto · 2026-09-18
- Reddit 网友提议 AI 扫描路面缺陷自动向市政府集体索赔 — InvestigatorIll3928 · 2026-09-18
- Shopify 工程师受 Tobi 启发,用 Qwen 在浏览器跑起 Jev 实验 — multiply_matrix · 2026-09-18
- Baseten 推出服务端联网搜索,开源模型延迟降 15% 免编排 — AccBalanced · 2026-09-18
- MCP 社区圆桌:非技术人群入场,探讨注册表与五年愿景 — digitarald · 2026-09-18