同一模型配不同 Harness,即成三类不同 Agent
hugobowne · x · 2026-08-17
帖子指出,同一个基础模型在不同的“约束”下可以表现出完全不同的行为模式,成为截然不同的智能体:
- 编程 Agent:在代码约束下,能检查仓库、编辑文件、运行测试、恢复错误并连续工作一小时。
- 客服 Agent:在客服系统中,仅限几轮对话、受限工具、严格退款规则,且敏感情况自动转人工。
- 自由 Agent:在沙箱中给予 Bash,能编写代码以创造其原生工具集中不具备的新能力。
核心观点是模型提供底层能力,而 Harness 决定了它能看到什么、能做什么、能工作多久、记什么以及必须在哪里停止。盲目复制某一种 Agent 的架构(如 Claude Code 或 Deep Research)到所有场景是错误的,合适的 Harness 取决于具体任务,且随着模型能力的提升,过去必要的脚手架可能变成累赘。
「编程与Agent」频道最新
- MIT 论文:临床多智能体会互相带偏,裁判 Agent 才能发现 — MIT · 2026-08-17
- 构建 AI Agent 的防错优先级:架构优于人工 — MikeBirdTech · 2026-08-17
- 2026 AI 工程师成长路线图:开源库全收录 — ZabihullahAtal · 2026-08-17
- Anthropic 发布 817 项网络安全技能数据集 — mukul975 · 2026-08-17
- MoneyPrinterTurbo 破 10.5 万星:一键把关键词变成高清短视频 — harry0703 · 2026-08-17
- 实测对比:Sol 与 GLM-5.3 发现代码高危漏洞,Claude 未检出 — morgymcg · 2026-08-17