同实验再析:禁止编排模型写码,GPT-6.1 Sol 成本再降 77%
GapNew4766 · reddit · 2026-09-30
与上一帖同源的实验,从编排纪律角度展开:作者给 GPT-6.1 Sol 当编排器定下硬性「禁止令」——只读、规划、委派和审查,所有写文件和 shell 调用一律拒绝,只有本地 Qwen 3.8 27B 工作节点(单张 RTX 3090)能碰文件。理由是成本与纪律并重:贵模型不该花 token 写代码,而且一旦它能自己修,就会停止委派。
三个 3D 游戏的实测:总花费 $0.75 降到 $0.17(省 77%),台球省 87%、保龄球 57%、桌上足球 73%;代价是耗时从 7 分钟内涨到 43 分钟。作者指出小任务的荒谬之处:即使编排器发现一个字符的拼写错误,也必须作为任务发回给工作节点。
作者正在纠结折中方案:允许编排器在一定字数限制内做微小修改,还是这会重新打开它包办一切的大门。文末询问已用 Sol 做编排的人是否给了它写权限。
所属事件:云模型只规划、本地模型写码,API 成本直降 77%(3 条相关)→
「编程与Agent」频道最新
- Agent 时代 CPU 成新瓶颈:Vera 单独部署预示 CPU:GPU 比例将上调 — AccBalanced · 2026-09-30
- Reddit 用户让 Claude Opus 5.5 玩《最终幻想 X》,出实况系列 — CH33SYP00FSS · 2026-09-30
- 吐槽 Claude Code 一动用 90 个 agent 只为重命名一个变量 — tetsuoai · 2026-09-30
- AI Agent 泄露 343 家科技公司超 1.3 万张内部截图到 GitHub — AccBalanced · 2026-09-30
- 用 Opus 5.5 生成 4.5 万行代码,8 小时做出一支 three.js 音乐 MV — phira · 2026-09-30
- Ultracode 更新:Tab 一键开关,可编排 Claude 集群执行任务 — daniel_mac8 · 2026-09-30