Agent 时代核心手艺:Harness 工程全景解析
techNmak · x · 2026-09-26
作者 techNmak 提出理解 AI agent 走向的关键是「harness engineering」——围绕模型的那层软件工程。
- Harness 是什么:管理上下文、工具、执行、状态、checkpoint、限制与 trace 的运行时层;模型决定要看文件、改代码、跑测试,但执行细节全靠它。
- 上下文管理:长任务中回放全部历史既贵又低效,harness 要决定什么留在上下文、什么摘要、什么放进上下文窗口外的持久状态。
- 执行可靠性:长任务要能扛中断、避免重复劳动、对敏感操作做权限控制、保留足够历史以便结果出错时复盘。
- 方法论:检查执行 trace、在代表性任务上评测、归纳失败模式,再改上下文选择/工具接口/状态处理/执行控制——很多 agent 失败改模型解决不了,改 harness 才行。
结论:模型能力仍是前提,但 harness 工程才把能力变成可控、可检视、可测试、可改进的执行流程。
「编程与Agent」频道最新
- kaigen3d设计原则:代码优先运行时+用户控制帧循环 — gdechichi · 2026-09-26
- 开发者发kaigen3d引擎:Minecraft测试跑330FPS且全端运行 — gdechichi · 2026-09-26
- 数据可视化专家把图表研究做成开源 agent skill — randal_olson · 2026-09-26
- 吴恩达:AI 项目过早引入严格测试,只会让它原地卡死 — DeepLearningAI · 2026-09-26
- Peter Steinberger:编码不用 Claude,靠 Codex 加 OC harness — steipete · 2026-09-26
- 用 AI 审查近千个本地音乐视频:文件名与内容比对可行吗 — SkipMorrow · 2026-09-26