论文提出四个条件,定义语言模型何时算代码代理
alex_verem · x · 2026-07-22
一篇新论文试图给“coding agent / agent harness”下定义,认为让语言模型真正变成代理系统,需要同时具备四个条件:
- 运行时循环:把推理、行动、观察交织起来,而不是只回答一次就结束。
- 工具接口:让模型能感知并改写外部环境。
- 主动上下文管理:避免模型被困在固定上下文里。
- 执行状态跟踪:持续记录任务与环境状态。
作者还追溯了 harness 这个隐喻从马具到 Claude Code 的演变,强调关键不在模型本身,而在包裹模型的那层工程基础设施。
「编程与Agent」频道最新
- Cognition SWE-2 用 KKT 对偶优化长度惩罚,一次 RL 推移 Pareto 曲线 — YouJiacheng · 2026-09-11
- 首届 Three.js 大会落地巴黎,AI 正缩短从想法到原型的距离 — OdinLovis · 2026-09-11
- 观点:Agent 真正的瓶颈是企业数据工程能力 — dhruv2038 · 2026-09-11
- 实测戳破 RTK 省钱神话:token 省了,账单分文未降 — Bartaseth · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11
- 投资分析师求教:如何用 Claude 搭建尽调 Agent 工作台 — Careless_Tie2286 · 2026-09-11