从零手写 Agent Harness:不改提示词让 GPT-3.5 的"完成"变真
tejaskumarlol · reddit · 2026-09-14
同一作者的完整版复盘(含全部代码与链接):用 GPT-3.5 Turbo + Playwright 浏览器工具,任务是给 Hacker News 头条点赞,提示词全程不变,只靠 harness 演进:
- v0 裸循环:撞登录墙仍报成功;
- v1 护栏:代码强制迭代/消息上限,粗暴裁剪上下文;
- v2 验证:确定性函数读 tool call 历史,判定通过/失败,最多重试 3 次,从此"诚实地失败";
- v3 harness 侧登录:检测登录页后由 harness 注入模型看不到的凭据,6 次迭代完成。
作者给出工作定义:agent harness 是围绕模型、给它现实感的一切——工具注册表、上下文管理、护栏、循环与验证步骤。附完整博客与分步代码仓库,并引用 Mitchell Hashimoto 的 "harness engineering" 与 LangChain 的 harness 解剖文作为术语出处。
所属事件:开发者用 GPT-3.5 驱动真浏览器完成点赞任务全程不改提示词(2 条相关)→
「编程与Agent」频道最新
- chrome-mcp 驱动真实 Chrome 填 30 字段表单,148 步全程可审计 — SYEDNIICK · 2026-09-14
- 9router + 本地路由兜底,解决 Agent 任务中途被限流打断 — phanue1 · 2026-09-14
- SQLite/S3 加每目录 OPA 脚本:一条适合 AI agent 的文件系统构想 — tobowers · 2026-09-14
- SIEM 工单交给 AI 处理:工作流工具还是纯 Agent? — Melodic_Tooth6885 · 2026-09-14
- Agnes 2.5 Pro Beta 对比 GPT-5.6 Sol:同题 3D 模拟成本 $0.20 vs $1.70 — iamaliveix · 2026-09-14
- 给本地 Agent 装上眼睛:Qwen2.5-VL 自建监控数据集,数据不出家门 — AIForOver50Plus · 2026-09-14