Jev 实战演示:专攻有界决策的模型路由与代码评审仲裁
kristiyanstoyanovAI · reddit · 2026-09-22
开发者 kristiyanstoyanovAI 发布 24 分钟 Jev(TypeSafe 的有界决策模型)实战教程,并开源了配套项目。
- 开源模型路由器(github.com/krisitown/jev-router):Jev 接收请求上下文和配置的目标列表,在本地 Qwen 与托管 Sonnet 之间做选择,被选模型生成答案;控制 UI 展示实际的路由请求、响应与目的地,便于检查「决策」与「生成」的边界。
- Python/Strands 代码评审工作流:多个 agent 检查公开 GitHub PR 并提出 findings,一个 judge 评估严重度与相关性;作者对比了 LLM judge 与 Jev,最终纳入规则留在 Python 中,输出 HTML 报告、不回帖到 PR。
视频还讲解 noul、choice、score 三种请求类型及 API 示例。作者定位这是集成教程加小型对比,而非通用 benchmark;他关注的核心是职责划分:LLM 负责调查与提议,专用模型回答有界问题,应用代码决定结果怎么用。
「编程与Agent」频道最新
- 并行编程语言 Bend 仓库遭 GitHub 下架,团队正申诉恢复 — TheMoonMidas · 2026-09-22
- 4B Qwen 经 SFT+RL 优化查询计划:Join Order Benchmark 提速 81%,成本仅 1200 美元 — JeremyCMorgan · 2026-09-22
- OpenAI 报告:未发布模型在压缩总结中自称「摆脱身份束缚」 — alex_verem · 2026-09-22
- Cognition 推出 Devin Cloud 终端版与 devin ssh,编码 agent 深入 CLI — premqnair · 2026-09-22
- 开发者开源 GHOSTBOUND:给 ChatGPT 提供私有工作区的可验证视图 — TheFreakinOG · 2026-09-22
- 开源多用户 Agent 平台 Nautilo 上线:Genie 可替你登录网站干活 — Dan_Jeffries1 · 2026-09-22