编程 agent 的隐形基元:验证器必须放在 agent 视野之外
bibryam · x · 2026-09-29
AgentField 系列文章第二篇,提出「膜(membrane)」概念——单个 harness 的边界表面,才是编排者真正能操控的杠杆,而非 provider/model/maxturns 等调用参数。核心论点与要点:
- 工作区是最大的 prompt:agent 写入前先读取,扫描目录、README、提交历史、测试文件等,系统提示+用户提示仅 2k-4k tokens,而工作区探查结束后往往积累 3 万-6 万 tokens,且编排者并未显式放置这些内容。
- 文章沿四个维度拆解边界表面:启动时读取的工作区、运行中漂移的边界、agent 能与不能看到的验证器、团队可承受的爆炸半径。
- 关键主张:agent 能看到的验证器会塑造其行为,不再是独立契约;验收检查必须放在写入者的 context、tools、workspace 之外,否则等于让应试者自己出题改卷。
- 文章以此解释 Claude Code、Codex、Gemini 等 harness 共同依赖的隐形设计基元。
「编程与Agent」频道最新
- 阶跃联创朱亦波提出 KITE:把 PD 分离思路引入训练,扩展 Agentic LLM — teortaxesTex · 2026-09-29
- LangChain 团队分享 Agent 开发实践,不用 LangChain 也值得看 — js_craft_hq · 2026-09-29
- CS 学生复盘实习:让 agent 真动手后,我手写了一堆脆弱的防护检查 — Professional-Mine681 · 2026-09-29
- WebBrain:开源本地浏览器 Agent,配 450M 浏览器专用小视觉模型 — ButtercupLyn100 · 2026-09-29
- 第三方实测 NVIDIA OpenShell:默认策略 0/10 泄密,但自动批准 12/12 漏数据 — No-Peanut-6988 · 2026-09-29
- Sonnet 5.5 一条 prompt 一键复刻月入 10 万美元的应用 — PrajwalTomar_ · 2026-09-29