模型不等于 Agent:一篇从第一性原理讲透 Agent Harness 的技术手册
techNmak · x · 2026-10-04
作者指出「harness 工程」是构建可靠 AI agent 最重要却常被简化为提示词+工具调用的部分:一个强大的模型本身并不构成 agent,还需要一套控制层来决定模型看到什么上下文、能用哪些工具、状态如何在步骤间存续、哪些动作需要审批、失败如何返回、何时重试与停止、以及如何验证任务真正完成。
这套外围层会贯穿整个 agent 技术栈:工具设计影响模型行动的难易,上下文策略决定长任务中信息的存留,沙箱与权限边界约束生成代码的可达范围;工具越多反而可能因歧义增加让 agent 变差。这也解释了为什么同一模型驱动的两个 agent 表现可能截然不同。
作者整理了一份技术手册,从第一性原理出发覆盖 agent loop、Agent-Computer Interfaces、MCP、skills、活动上下文 vs 持久状态、压缩、沙箱、权限、凭据、prompt injection、执行预算、验证与评估循环、长时间运行恢复、幂等性、子 agent、可观测性与常见误区,全部基于原始研究与当前框架文档。
所属事件:模型不等于 Agent:Harness 工程被严重低估(2 条相关)→
「编程与Agent」频道最新
- xAI 员工自曝用 50+ 个 Grok bot,靠管理 bot 编排调度 — petergyang · 2026-10-05
- arXiv 论文揭示:个人 Agent 记忆越多反而越容易出错 — rohanpaul_ai · 2026-10-05
- Mac 上的 iOS 模拟器竟能直接跑在手机里,开发者惊呼不知道这功能 — itsOmSarraf_ · 2026-10-05
- 实验:个人 Agent 记忆超 10 行开始失灵,计数任务改用代码零违规 — rohanpaul_ai · 2026-10-05
- Raven V2 让 Rhino/Grasshopper 也能 agentic 建模,已覆盖 1.5 万席位 — burhop · 2026-10-05
- 独立开发者用 AI 全流程做游戏:半月连推三款,一款已上架 App Store — ezshine · 2026-10-05