别再折腾 harness 了:决定 agent 成败的是模型和端点
aidenclarke_12 · reddit · 2026-09-13
- 作者认为 opencode、cline、aider、Claude Code 等编码 harness 本质上收敛于同一个循环:系统提示 + 工具定义 + 上下文管理 + 模型调用,外壳差异主要是 UX 和约定。
- 真正决定 agent 表现的是更下面一层:模型(工具调用可靠性、长上下文数百 K 后的稳定性)和端点(每 token 价格、缓存行为、高负载下的吞吐,同一权重不同服务商差异很大)。
- 唯一值得认真挑 harness 的理由是上下文处理策略:压缩多激进、每轮重发什么。
- 实操建议:由于各家都兼容 OpenAI API 格式,端点是个自由变量——保持现有 harness 不动,改个 base URL 和模型 ID 即可换模型 A/B 测试,例如用 DeepInfra 这类一个 key 通吃多模型的服务。结论:选一个上下文处理符合自己工作流的 harness,然后固定它,把精力花在模型和端点上。
「编程与Agent」频道最新
- px0:单二进制只读 IDE,冷启动不足 1ms 专为 AI agent 验证而生 — arpit_bhayani · 2026-09-13
- 开发者弃用 Claude,改用浏览器版 Strawberry 工作流提效 — damienghader · 2026-09-13
- 「混沌之上加 AI 只会放大混沌」:笔记系统先行的最佳实践 — dSebastien · 2026-09-13
- 2 万条笔记的 Obsidian 库里养一个 AI 助手:先有系统才有 AI — dSebastien · 2026-09-13
- Claude Skills 实测:会议记录一键变 Word 行动清单 — eyishazyer · 2026-09-13
- AllSpark 开源 Iris-mini/pro:同级最强开放权重搜索智能体 — The Decoder · 2026-09-13