云规划+本地编码实测:成本降 2.7 倍但耗时长 9 倍
GapNew4766 · reddit · 2026-09-29
作者用同一个任务(单页五个物理小场景、一行提示词、一次自主运行)对比了三种 agent 架构:
- Sonnet 5.5 单独干:完成 4/5 个场景,9 分钟,花费 $1.83
- Sonnet 5.5 规划 + 本地 Qwen 3.8 27B 写码:完成 2/5 个场景,85 分钟,花费 $0.67
- Qwen 3.8 27B 单独跑在 RTX 3090 上:完成 1/5 个场景,26 分钟,零成本
省钱的原理是规划器只写简报不写代码,输出 token 从 37.9K 降到 5.4K。但本地模型是明显瓶颈:运行时间从 9 分钟膨胀到 85 分钟,完成质量也更差。更关键的发现是,三种配置的 agent 都汇报「完成、无错误」,而实际有些场景视觉上是坏的——「agent 说做完了」仍不是可靠的完成信号。作者开源了所用框架 Atomic Agent,并向社区征集如何自动验证视觉/物理正确性。
所属事件:开源 Agent 架构实测:云规划加本地执行降本但更耗时(2 条相关)→
「编程与Agent」频道最新
- 周末 vibecode:DeepSeek 规划器驱动的实时版《Among Us》 — ai · 2026-09-29
- 为什么 vibecoding 造不出 MacAMP:好东西皆有架构 — HankYeomans · 2026-09-29
- MacAMP 作者晒架构图:为什么音频播放器没法纯 vibecode 出来 — HankYeomans · 2026-09-29
- 用 Claude 插件全自动剪辑视频并多平台分发,首支成片上线 — Scobleizer · 2026-09-29
- 作者晒架构图:为什么 vibecode 复刻不出 MacAMP — HankYeomans · 2026-09-29
- Swares 代理市场自称成交额破 5000 万美元,上架产品超 6000 个 — KyeGomezB · 2026-09-29