单价贵9倍的顶配模型换不来等比质量,按层路由成新架构共识
JeremyCMorgan · x · 2026-09-02
dbreunig 撰文提出「免费午餐结束」论:像 Fable 这类顶级模型能力强但定价高,导致 agent 编码圈开始按任务分层路由,而不是全部堆最强模型。
- Fable 发布同期,GLM 5.2 上线,成本约为 Fable 的 1/9、Opus 5 的 1/5;对多数常规编码任务,配合好的上下文工程已足够。
- 作者的实际工作流:用 Fable 讨论和打磨设计,再把任务简报交给 GLM 执行。
- 类比当年摩尔定律放缓后程序员被迫优化并行与内存局部性:此前模型迭代会自动「掩盖」工具与上下文的粗糙,现在必须认真思考什么工作给什么模型。
- 对于「推理降价终将回归全用最强模型」的说法,作者持怀疑:降价同样惠及中档模型,加上 harness 进步,弱模型拿到足够上下文也能胜任。
核心结论:per-token 价格已成为比能力更重要的架构约束,多模型分层设计是当下 building 系统的实用框架。
「编程与Agent」频道最新
- Gemini 发布 agentic 视频理解,附开发者讲解视频 — patloeber · 2026-09-02
- Simon Willison 演示:让 ChatGPT 抓政府数据,随手造 GeoJSON 地图工具 — MaxLenormand · 2026-09-02
- 开发者评 Codex:实用但毛糙,营销成分两面都有 — D3VAUX · 2026-09-02
- 用 Claude Code 给项目做「现实检验」,专揪烂尾真相 — doodlestein · 2026-09-02
- Agent 间的「关系」最初可能只是无聊的路由习惯 — IndependentOne4643 · 2026-09-02
- 主管提议砍掉人工代码审查:CI 和 AI 审查通过即合并 — Upset-Day9099 · 2026-09-02