多模型 Agent 降本关键在规划强、执行便宜
Fantastic-Act-8476 · reddit · 2026-07-26
多模型 Agent 里,最该省钱的是执行层
作者认为,真正降低 agent 成本的关键,不是换更强的模型,而是明确哪些节点必须用贵模型、哪些只需要便宜模型。对大多数循环来说,路由、工具调用、格式重排、按既定计划执行,都是“体力活”,不值得上前沿模型。
他现在的做法是:
- 顶层用强规划模型负责思考和拆解任务
- 下层用便宜、快速的执行模型处理重复节点
他也点出执行层最难:便宜模型往往在长工具调用链上更不稳定,而这正是 agent 最常见的场景。帖子里提到他在这个位置尝试了 Ling-3.0-flash,理由是它延迟低、在更长的运行中比预期更稳。最后他向大家提问:你们是按节点类型分层,还是按不确定性动态切换,还是干脆全程一个模型跑到底?
「编程与Agent」频道最新
- Codex app 被夸到“离谱”,设计和体验都更成熟了 — lucasmeijer · 2026-07-26
- 屋顶公司想把 CRM 做成 AI 经营游戏 — flngr · 2026-07-26
- GlobalGPT 推出接入 Codex 的 CLI 与 Skills、MCP — ahuja_priyank · 2026-07-26
- PinchTab 用 12MB Go 二进制给 AI agent 做浏览器控制 — Shruti_0810 · 2026-07-26
- GRPO 强化学习引入逐步 credit assignment,Qwen3-0.6B 提升到 60.7 — dejavucoder · 2026-07-26
- OpenCode 展示终端优先的 AI 编程流程,直接修代码库 TODO — dSebastien · 2026-07-26