Claude+小模型混合架构,1000次决策成本从605美元降到0.17美元
jamestagg · x · 2026-09-30
polydao 分享了一套 agent harness 技能,声称将 1000 次决策的成本从纯前沿模型的 605 美元降到 0.17 美元,核心思路是「Claude 提议,小模型 Jev 作答,代码做最终决定」,每一步都留下可回放的 receipt。
工作流分六步:
- propose:Claude 写方案和补丁,但不做决定
- filter:代码先过滤掉机器上跑不通的路线,Jev 看不到无效选项
- answer:Jev 从代码给的菜单中以概率选出答案,不确定时可弃权
- re-check:代码对照实时状态校验,过期结果走 fallback
- act:工具经正常审批路径执行
- receipt:每步落日志,可对新策略回放
实测数据:中位单次调用 0.2s,桌面端每步约 0.0002 美元,49 个 WebMCP 任务全部通过。关键洞见是把「我不知道」当成合法答案——当 Jev 置信度仅 38% 时走预先写好的 fallback,而不是让昂贵模型硬答。
「编程与Agent」频道最新
- ccsession 新版支持 Snowflake CoCo CLI,模糊搜索恢复 Agent 会话 — 4310sy · 2026-09-30
- shadcn 作者发声:欢迎复制组件,但别整站照抄 — shadcn · 2026-09-30
- 61 天实测:Hook 显示成功,Claude Code 上下文实际只送达 11% — JhouHate · 2026-09-30
- 开源小红书相关词爬虫 Skill:Codex 一小时抓万条长尾词并自动评分 — vista8 · 2026-09-30
- Constella 接入 Blender MCP:缺口不少但上限很高 — sidahuj · 2026-09-30
- 律所 AI 工作组实测多模型,Claude 全面胜出 — jkubicki · 2026-09-30