云模型只规划、本地模型写码,API 成本直降 77%

一组实验对比了三种方式构建三个小型 3D 游戏(台球、保龄球、桌上足球):让 GPT-6.1 Sol 全包,或让其只做规划、由单张 RTX 3090 上运行的本地 Qwen 3.8 27B 执行写码。结果后者显著更省,API 账单直降 77%。作者强调编排纪律:给 Sol 定下硬性「禁止令」,只读、规划、委派和审查,所有写文件和 shell 调用一律拒绝。开源项目 AtomicBot 也分享了类似的 planner/worker 架构设计,成本降至原来的约四分之一。

2026-09-30 ~ 2026-09-30 · 3 条相关