实测「云端规划+本地执行」:Sonnet 调度本地 Qwen,成本省 2.7 倍但质量打折

GapNew4766 · reddit · 2026-09-29

作者用三种配置跑同一组 5 个物理场景生成任务(单行提示、每场景 8 秒、无人工修复),验证「便宜本地模型+贵云模型」分工是否真省钱:

反向分工(Qwen 规划、Sonnet 写码)拿到 4/5、14 分钟,但成本反超纯 Sonnet,因为每个云端 worker 都要重读上下文。

结论:分工确实压账单,但省的是钱,赔的是时间和质量;规划模型省 token 才是省钱关键。设置:openrouter 的 Sonnet 5.5 + 本地 Q4 量化 Qwen 3.8 27B,融合模式在其自研 atomic agent 中实现。

所属事件:云规划加本地执行实测:省 2.7 倍成本但耗时长 9 倍(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →