同实验再析:禁止编排模型写码,GPT-6.1 Sol 成本再降 77%

GapNew4766 · reddit · 2026-09-30

与上一帖同源的实验,从编排纪律角度展开:作者给 GPT-6.1 Sol 当编排器定下硬性「禁止令」——只读、规划、委派和审查,所有写文件和 shell 调用一律拒绝,只有本地 Qwen 3.8 27B 工作节点(单张 RTX 3090)能碰文件。理由是成本与纪律并重:贵模型不该花 token 写代码,而且一旦它能自己修,就会停止委派。

三个 3D 游戏的实测:总花费 $0.75 降到 $0.17(省 77%),台球省 87%、保龄球 57%、桌上足球 73%;代价是耗时从 7 分钟内涨到 43 分钟。作者指出小任务的荒谬之处:即使编排器发现一个字符的拼写错误,也必须作为任务发回给工作节点。

作者正在纠结折中方案:允许编排器在一定字数限制内做微小修改,还是这会重新打开它包办一切的大门。文末询问已用 Sol 做编排的人是否给了它写权限。

所属事件:云模型只规划、本地模型写码,API 成本直降 77%(3 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →