自建 Agent Harness:真正决定成败的往往不是模型
ghumare64 · x · 2026-10-02
作者 ghumare64 分享自建 agent harness 的心得:agent 工作流的好坏很大程度上与模型无关,关键在于——
- 上下文如何加载、有哪些可用工具、状态存在哪里、哪些操作需要人工审批、失败后如何检查并从断点续跑。
- 这些是换模型或换编码 agent 时也想保留的决策,这正是「个人 harness」的价值:让配置反映你真实的工作方式,而不是围绕每个工具的默认值重建习惯。
- 可组合性是核心:编码 agent、shell 进程、检索函数各自是独立组件,给它们清晰接口即可独立替换——换 agent 保留工具、换检索方式不换执行层、审批规则跨 worker 复用。
- 换模型仍可能出问题(prompt、工具调用、输出质量需重测),但差异应该被隔离和评测,而不是推倒重建整个工作流。
- 不必全部自己写:从现有工具入手补齐缺失连接,需要时再抽取可复用组件。
「编程与Agent」频道最新
- 新范式神经符号化计算机操作:让 Agent 学会肌肉记忆,成本降 99% — xwang_lk · 2026-10-02
- Stripe 代付 gas 费:智能体稳定币支付再无门槛 — jeff_weinstein · 2026-10-02
- 「旗帜游戏」论文:智能体群凭碎片协作推理,探索群体动力学 — Hidenori8Tanaka · 2026-10-02
- Coinbase 推出 Link 新 API,可验证智能体身份代用户行动 — jeff_weinstein · 2026-10-02
- 开发者让 AI Agent 值守开源仓库,自动汇报需跟进的最新动态 — IanArawjo · 2026-10-02
- TiboTattle 用共享 token 用量监测 Codex 额度暗改,但只支持自家 — itisyeetime · 2026-10-02