用 Jev 决策模型搭 Agent Harness:15 项实测里哪个决策点真有用
Prompt Engineering · youtube · 2026-09-29
Prompt Engineering 频道围绕 TypeSafe 的 System 1 决策模型 Jev 搭建了一套 agent harness(基于 Pi 编码 agent + Gemini 3.8 Flash),对着一个布满陷阱的凌乱 Postgres 数据库跑了 15 项测试。
关键内容:
- 架构:Pi agent + Gemini 模型 + Neon 数据库(每次 agent 运行使用独立的一次性生产分支),LangChain 提供 middleware
- 四个决策点分别实测:router(路由)、context picker(上下文选择)、gate(门控)、verifier(校验)
- 有帮助的决策点出乎作者预料;当 harness 的 gate 拒绝操作时,agent 会主动绕路寻找变通方案
- 视频讨论了 System 1 vs System 2 模型的分工、token 成本与 verifier 的开销
完整代码开源在 GitHub(PromtEngineer/jev-harness),并参考了 LangChain 官方 Jev harness 教程与 Elvis Saravia 的 Pi harness 指南。
「编程与Agent」频道最新
- Anthropic 智能指数登顶已超百日,作者开源图表 skill 实测 — randal_olson · 2026-09-29
- Capy 推出常驻智能体 Captains,团队消息已靠 agent 互相转达 — garrytan · 2026-09-29
- 改一句 prompt 分数涨了?作者教你用重复实验排除噪声 — KhuyenTran16 · 2026-09-29
- vibe coding 的真相:关键部分靠理解,其余只需说继续 — robleclerc · 2026-09-29
- 用户实测:Opus 5.5 敢删代码,主动清理 vibecoded 项目里的垃圾实现 — jarrodwatts · 2026-09-29
- 开发者因 Entra ID 认证太折腾,做出 MCP 托管平台 foro — Danielloesoe · 2026-09-29