通用 Agent 未必赢,专用 Harness 可能更强

NirantK · x · 2026-07-13

这条回复围绕“agent wars”展开,核心观点是:**代码和编程语言在代理工作流里更占优势**。 - 引用 Lilian Weng 的 harness 评测后,作者认为很多“agent 不行”的论文,使用的是旧一代模型,缺乏识别失败的能力。 - 他的判断是:编程语言本身提供了更好的**确定性上下文工程**,因此真实有效的系统往往更依赖代码化的编排,而不是纯自然语言式 agent。 - 进一步预测:**通用 harness**(如 Claude Code、Codex 这类)未必能赢,未来可能是**专用 harness** 更强,因为“通用”会带来效率和控制上的劣势。

所属事件:观点称专用编程智能体胜过通用 Agent(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →