生产环境选模型别问哪个最强,该按四维打分做路由
TeqPumpkin999 · reddit · 2026-09-18
一位开发者在 Reddit 提出把模型选型从「哪个模型最好」转变为路由问题:为工作流中每个任务按四个维度打分——
- 推理难度
- 答错的代价
- 数据敏感度
- 预期量级/成本上限
再据此路由:大量低风险任务用开源权重或微调模型;高风险判断交给前沿推理模型;OCR、embedding、审核等用专用模型;另设 eval/judge 模型做回归门禁。
作者想了解他人生产环境是按任务族路由,还是统一用一个模型直到出问题。
「编程与Agent」频道最新
- NVIDIA 开源 SoL-Pi:让编码 Agent 省 45% token、降三成 API 成本 — songhan_mit · 2026-09-18
- Awesome Code-as-X 合集:用程序作为中间表示统一 agent 研究 — ccloy · 2026-09-18
- 实测 8 个 AI 个人助理无一个能替你给朋友发短信,卡在 10DLC — iamstanty · 2026-09-18
- Zalando 在 Kubernetes 上构建内部 Agent 平台的规模经验 — bibryam · 2026-09-18
- 开发者调侃新编程流程:发推恶搞概念,再丢给编码 Agent — airesearch12 · 2026-09-18
- 开发者吐槽 Opus 5 连构建运行项目都搞不定 — lucasmeijer · 2026-09-18