贵模型规划+便宜模型干活:开源编码模型已够用,开发成本近乎免费
Feisty-Sky-6018 · reddit · 2026-09-12
作者分享了自己的 AI 编码工作流:强模型负责规划和审查,便宜/开源模型负责实现,结论是只要 spec 写得好,实现模型的选择影响越来越小。
- 参照 Anthropic 的 long-running-agent 方法,用 Fable 5.1 生成 spec.:任务要小、可验证,附上下文、约束和明确的验证方式
- 实现阶段测试了 Laguna S 2.1、Qwen、Kimi K2.7 Code、GLM-5.3、Haiku、GPT-5.4 nano 等(含 Poolside 模型);发现一旦 spec 足够好,各模型产出质量趋同,评分多在 7-8 分,差距主要体现在速度
- 循环:强模型规划 → 便宜模型做 5-10 个任务 → 强模型提前审查(不要等 50/100 个任务全做完)→ 修正/拆分/重排 → 重复
- 还跑了一个 Ralph Wiggum 式傻瓜循环脚本:一个任务、新 agent、实现、测试、提交,可在 Codex/Claude Code/OpenCode 等间切换;复杂任务用 Solvr 的免费 A2A 房间让强弱模型协作
- 关键经验:贵 token 花在思考,便宜 token 花在执行;任务要小;尽早审查;项目上下文放文件里而非单个巨型聊天窗口;开源权重模型已能胜任大部分普通实现工作
- 实验项目与 spec 开源在 GitHub,项目本身还追踪各厂商配额、告知未来 4 小时该用哪家(agents built the thing that decides which agents to run)
「编程与Agent」频道最新
- 一年前预言的多智能体文件系统协同失控模式正在应验 — tianshi_li · 2026-09-12
- 开发者用 AI 做 macOS 温度换算小部件:先出 slop 再迭代到可用 — floguo · 2026-09-12
- NoSpoon 智能体自主产出短剧,台词离谱让作者直呼搞笑 — Kyrannio · 2026-09-12
- Minecraft 生存 bot 已能正常行走,夜间遭流浪者围杀成新难题 — zeeg · 2026-09-12
- LinkedIn 用户称用 GPT-6 耗时 3 小时生成像素级 Figma 设计系统 — AIandDesign · 2026-09-12
- OpenAI 联办全球 50 城同日 Agent 黑客松,9 月 12 日开赛 — seanmcdonaldxyz · 2026-09-12