论文提出四个条件,定义语言模型何时算代码代理
alex_verem · x · 2026-07-22
一篇新论文试图给“coding agent / agent harness”下定义,认为让语言模型真正变成代理系统,需要同时具备四个条件:
- 运行时循环:把推理、行动、观察交织起来,而不是只回答一次就结束。
- 工具接口:让模型能感知并改写外部环境。
- 主动上下文管理:避免模型被困在固定上下文里。
- 执行状态跟踪:持续记录任务与环境状态。
作者还追溯了 harness 这个隐喻从马具到 Claude Code 的演变,强调关键不在模型本身,而在包裹模型的那层工程基础设施。
「编程与Agent」频道最新
- 让 Sol 解释 ExploitGym,它却开始克隆仓库配防火墙 — JensHonack · 2026-07-22
- Hermes agent 寻找便宜又能跑长任务的开源模型 — OkCare6395 · 2026-07-22
- Fable 5 7 月基准里 PostgreSQL 以 53% 领跑数据库选择 — dshukertjr · 2026-07-22
- Palo Alto Networks CEO:前沿模型先测自家代码和配置 — Scobleizer · 2026-07-22
- Buzz 新增 Grok Build 支持,可接入 Claude Code 和 Codex — Daniel_Farinax · 2026-07-22
- Google 的 CodeMender 已独立推出,最强版本仍需邀请 — shashib · 2026-07-22