Agent Harness 分级榜引爆厂商锁定之争
一份 agent harness 分级榜在开发者社区引发连锁争论,从前 Segment CTO Paul(pvncher) 质疑榜单公平性开始,逐步延伸到 OpenAI 将上下文压缩(compaction)内置进 Responses API 是否构成厂商锁定、以及自建 harness 是否还有价值。参与者包括 pvncher、Sentry 创始人 David Cramer(zeeg)与 LangChain CEO Harrison Chase,目前并无定论,但多位知名基础设施厂商负责人公开表达了对实验室生态封闭化趋势的不满。
已确认
- pvncher 对某份 agent harness tier list 提出质疑:凡是在 OpenAI 或 Anthropic 模型上做自定义 compaction 的 harness 都应大幅降权,并追问若使用第三方工具该如何处理。
- OpenAI 已在 Responses API 端点中正式提供 compaction 能力,并定位为核心模型能力;pvncher 指出 compaction 与模型训练深度绑定,很难从模型侧剥离,开发者可用 Responses API 搭建自定义 harness。zeeg 亦参与讨论,质疑 compaction API 难以构成真正的竞争壁垒。
- pvncher 结合 2026 年秋的实战观察提出,agent harness 调优红利正在消失:一年前在自建 harness 中能轻易找到的优化收益,在最新模型上已很难复现——前沿实验室的官方 harness 虽不完美,但模型本身就是针对它们训练的,自建编排难以超越这种协同优化。这一观点在多个讨论帖中被反复转述,他还承认多 agent 方向仍有空间。
- zeeg 认为实验室若把 compaction 做成厂商锁定手段,情况已经很糟,部分厂商甚至移除了 reasoning;实验室应专注做好模型而非把客户往外推。他吐槽当前 coding agent harness 与 API 均为厂商专属,做 vendor-neutral 方案极其痛苦,且常需修改 harness 默认行为(工具、prompt 改写等)。
- Harrison Chase 明确反对"compaction 已被大厂锁死、应只在现有 harness 上做 MCP/插件层创新"的观点,核心论点是各实验室自带的 coding harness 未必是业界最好,开发者会逐渐转向开源模型并自建 harness。
- 在另一场讨论中,zeeg 与 Anthropic 工程师激辩 coding harness 该不该自研:zeeg 认为若模型越锁越死、harness 不许自研,开发者将难以创新,且 compaction 等问题尚未真正解决。
- pvncher 进一步指出,所有模型都在原生 harness 上训练,做过度的通用抽象必然损失性能,建议参考 T3 code 的做法;zeeg 则反驳称包裹原生 harness 与被包裹的 harness 本身没区别,只适合"构建通用编码 IDE"这类少见场景,把特定 harness 迁到 Codex 上只会更差。在 Codex 之辩中,zeeg 批评 Codex harness 实际功能有限,认为实验室垄断 harness 的时代不会长久,多数编码 harness 终将被更专业的专用 harness 取代。
- 在 agent 架构层面,pvncher 认为在 codemode 与专业化多智能体工具并存的时代,harness 并非无关紧要;但工程实践上无论用哪家厂商都应直连原生 API 格式与 compaction 端点,不要绑死单一厂商。zeeg 则认为没人会蠢到把产品建在单一供应商上,因此"harness 无关紧要",compaction API 这类能力目前仍属过度承诺。
- Simon Willison 引发另一场关于 agent 架构的争论:有人质疑自建 agent harness 相比直接构建在 OpenAI Responses API(含原生 compaction 端点)上是否确有必要。围绕 zeeg 的 agent 产品竞争力,pvncher 认为当前 compaction 等核心能力被上游锁定,只能在自定义 harness 中通过 Responses API 使用,套壳类 agent 产品竞争与创新空间受限。
为什么重要
- 这场争论触及 coding agent 生态的双重张力:一方面 compaction、reasoning 等模型能力应通过开放接口暴露给第三方 harness,还是作为实验室自家工具链的护城河;另一方面模型与官方 harness 的深度协同训练正在压缩自建框架的调优空间。
- 若头部实验室持续收紧模型接口,Sentry、LangChain 等基础设施厂商可能加速转向开源模型与自建 harness,重塑工具链格局。
2026-10-06 ~ 2026-10-06 · 20 条相关
一手来源
- 调优 agent harness 的红利正在消失:最新模型已与官方框架深度绑定 — pvncher ·
- Agent harness 分级榜引争议:用自定义压缩的应大幅打折 — pvncher ·
- OpenAI 在 Responses API 内置 compaction,被指或成厂商锁定手段 — pvncher ·
- 【源头】Agent harness 分级榜引争议:用自定义压缩的应大幅打折 — pvncher · 2026-10-06
- zeeg 质疑实验室借 compaction 锁定开发者生态 — zeeg · 2026-10-06
- 【源头】OpenAI 在 Responses API 内置 compaction,被指或成厂商锁定手段 — pvncher · 2026-10-06
- OpenAI 把上下文压缩做进 Responses API,开发者质疑难成竞争壁垒 — zeeg · 2026-10-06
- Sentry CEO 与社区争论:Coding Agent 套壳难有出路 — pvncher · 2026-10-06
- LangChain CEO 称实验室 harness 并非最强,开发者将转向开源模型自建 — zeeg · 2026-10-06
- Sentry CEO 与Anthropic 工程师激辩:编码 harness 该不该自研 — pvncher · 2026-10-06
- zeeg 吐槽 coding agent 生态:工具链被厂商绑定,中立方案难做 — zeeg · 2026-10-06
- 前 Segment CTO:编码模型都吃自家 harness,强行通用化必掉性能 — pvncher · 2026-10-06
- 开发者反驳通用层方案:特定 harness 迁到 Codex 上只会更差 — zeeg · 2026-10-06
- Agent 框架该不该建在 Responses API 上?开发者激辩封装取舍 — pvncher · 2026-10-06
- Sentry CEO:没人会绑死单一厂商,compaction API 目前仍属过度承诺 — zeeg · 2026-10-06
- 构建编码产品应直连原生 API 与压缩端点,别绑死单一厂商 — pvncher · 2026-10-06
- zeeg 反驳:实验室垄断 harness 的时代不会长久 — zeeg · 2026-10-06
- Codex 之辩:官方 harness 是否终将被专用 harness 取代 — pvncher · 2026-10-06
- 【源头】调优 agent harness 的红利正在消失:最新模型已与官方框架深度绑定 — pvncher · 2026-10-06
- 开发者亲历:2026 年自建 Agent Harness 已难跑赢官方框架 — pvncher · 2026-10-06
- 模型已深度适配官方 harness,自建 Agent 框架收益越来越难找 — menhguin · 2026-10-06
- Agent 调优红利消退:前沿模型已与官方 harness 深度绑定 — jdjohnson · 2026-10-06
- 模型越强 harness 越不重要:顶级工程师称 agent 外壳优化收益递减 — ctjlewis · 2026-10-06