实测「云端规划+本地执行」:Sonnet 调度本地 Qwen,成本省 2.7 倍但质量打折
GapNew4766 · reddit · 2026-09-29
作者用三种配置跑同一组 5 个物理场景生成任务(单行提示、每场景 8 秒、无人工修复),验证「便宜本地模型+贵云模型」分工是否真省钱:
- Sonnet 5.5 纯云端:$1.83 / 9 分钟 / 4.5 场景成功,质量最干净,但拒绝撞碎砖墙
- 本地 Qwen 3.8 27B(单张 3090):$0 / 26 分钟 / 仅 1/5,方块渲染成空心壳并瞬移,墙成一团黑影
- 融合模式(Sonnet 只写简报、Qwen 写全部代码):$0.67 / 85 分钟 / 2/5——Sonnet 输出从 37.9K token 降到 5.4K,成本降 2.7 倍,但耗时和精度都付出代价
反向分工(Qwen 规划、Sonnet 写码)拿到 4/5、14 分钟,但成本反超纯 Sonnet,因为每个云端 worker 都要重读上下文。
结论:分工确实压账单,但省的是钱,赔的是时间和质量;规划模型省 token 才是省钱关键。设置:openrouter 的 Sonnet 5.5 + 本地 Q4 量化 Qwen 3.8 27B,融合模式在其自研 atomic agent 中实现。
所属事件:云规划加本地执行实测:省 2.7 倍成本但耗时长 9 倍(3 条相关)→
「编程与Agent」频道最新
- 程序员自述:AI 辅助开发中每轮重构都会让旧问题迁移到新代码 — ssh4net · 2026-09-30
- 用户实测 Opus 5.5:速度快但常无视技术规格自行改写代码 — ssh4net · 2026-09-30
- Agent 上生产的两大痛点:错误连锁反应与 token 成本延迟 — datawithsuman · 2026-09-30
- 谷歌发布 PageBreak 智能体挖洞工具,自动验证实现近零误报 — rez0__ · 2026-09-30
- GLM-5.3 已为 389 个开源项目揪出 4249 个潜在漏洞 — JosephJacks_ · 2026-09-30
- 让 Claude Opus 自己标注时间戳配音:实测人机协作解说视频工作流 — RileyRalmuto · 2026-09-30