多模型 Agent 降本关键在规划强、执行便宜

Fantastic-Act-8476 · reddit · 2026-07-26

多模型 Agent 里,最该省钱的是执行层

作者认为,真正降低 agent 成本的关键,不是换更强的模型,而是明确哪些节点必须用贵模型、哪些只需要便宜模型。对大多数循环来说,路由、工具调用、格式重排、按既定计划执行,都是“体力活”,不值得上前沿模型。

他现在的做法是:

他也点出执行层最难:便宜模型往往在长工具调用链上更不稳定,而这正是 agent 最常见的场景。帖子里提到他在这个位置尝试了 Ling-3.0-flash,理由是它延迟低、在更长的运行中比预期更稳。最后他向大家提问:你们是按节点类型分层,还是按不确定性动态切换,还是干脆全程一个模型跑到底?

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →