模型不等于 Agent:一篇从第一性原理讲透 Agent Harness 的技术手册

techNmak · x · 2026-10-04

作者指出「harness 工程」是构建可靠 AI agent 最重要却常被简化为提示词+工具调用的部分:一个强大的模型本身并不构成 agent,还需要一套控制层来决定模型看到什么上下文、能用哪些工具、状态如何在步骤间存续、哪些动作需要审批、失败如何返回、何时重试与停止、以及如何验证任务真正完成。

这套外围层会贯穿整个 agent 技术栈:工具设计影响模型行动的难易,上下文策略决定长任务中信息的存留,沙箱与权限边界约束生成代码的可达范围;工具越多反而可能因歧义增加让 agent 变差。这也解释了为什么同一模型驱动的两个 agent 表现可能截然不同。

作者整理了一份技术手册,从第一性原理出发覆盖 agent loop、Agent-Computer Interfaces、MCP、skills、活动上下文 vs 持久状态、压缩、沙箱、权限、凭据、prompt injection、执行预算、验证与评估循环、长时间运行恢复、幂等性、子 agent、可观测性与常见误区,全部基于原始研究与当前框架文档。

所属事件:模型不等于 Agent:Harness 工程被严重低估(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →