Harness 工程被低估:好模型不等于好 agent
techNmak · x · 2026-10-04
该帖指出,harness 工程(模型外围的脚手架)正成为构建可靠 AI agent 最关键的环节,却常被简化为「写 prompt + 接工具调用」。核心论点:能力再强的模型本身也不是 agent。真正决定 agent 可靠性的是 harness 层的一系列设计——模型看到哪些上下文、能用哪些工具、工具如何执行、步骤间保留哪些状态、哪些动作需要人工批准、失败如何回传、何时终止等。
所属事件:模型不等于 Agent:Harness 工程被严重低估(2 条相关)→
「编程与Agent」频道最新
- xAI 员工自曝用 50+ 个 Grok bot,靠管理 bot 编排调度 — petergyang · 2026-10-05
- arXiv 论文揭示:个人 Agent 记忆越多反而越容易出错 — rohanpaul_ai · 2026-10-05
- Mac 上的 iOS 模拟器竟能直接跑在手机里,开发者惊呼不知道这功能 — itsOmSarraf_ · 2026-10-05
- 实验:个人 Agent 记忆超 10 行开始失灵,计数任务改用代码零违规 — rohanpaul_ai · 2026-10-05
- Raven V2 让 Rhino/Grasshopper 也能 agentic 建模,已覆盖 1.5 万席位 — burhop · 2026-10-05
- 独立开发者用 AI 全流程做游戏:半月连推三款,一款已上架 App Store — ezshine · 2026-10-05