同一模型换个 Harness,行为会因协议不同而大变
remilouf · x · 2026-08-04
这篇文章的核心观点很明确:同一个模型,放进不同的 harness 里,表现会差很多。
文章在说什么
作者举例说,把同一模型放到 Pi、Codex、Claude Code 或 OpenCode 里跑,会看到明显不同的行为:
- 有的 runtime 更会规划
- 有的工具调用更干净
- 有的则会陷入重试循环
而这些差异并不是因为权重变了,模型本身是一样的。
为什么会这样
文中把常见执行循环概括为几步:
- 把对话和工具发给模型
- 如果模型发出 tool call,就执行
- 把执行结果回传
- 重复直到结束
这个循环本身可能只有几百行代码,但作者强调:真正决定行为的,不只是循环,而是协议(protocol)设计。 harness 不是单纯实现,而是模型和外部世界交互的规则层,进而会显著改变能力表现。
「编程与Agent」频道最新
- 长上下文语音 Agent 取消 turn detection,改用异步压缩切换 — juberti · 2026-08-04
- 可安装 PWA 变成手机端 AI Agent,还能经 Tailscale 连本地 Codex — johnlindquist · 2026-08-04
- DeepSeek V4 Flash 登上 GBench,同价位表现领先且单轮推理更强 — teortaxesTex · 2026-08-04
- Agent DevTools 可本地调试 memory、检索和工具调用 — No_Firefighter8428 · 2026-08-04
- Codex 3 小时内端到端剪完一集三机位播客 — danshipper · 2026-08-04
- CTO 称工程师用 AI agent 自动化六成工作后被升职 — sloppenheimer · 2026-08-04