JevControl 开源:测试小模型能否接管 Agent 的例行决策
airesearch12 · x · 2026-09-28
开源项目 JevControl 旨在回答:AI Agent 过程中的日常小决策能否交给更小的模型处理,从而省成本。
- Agent 除生成回答外还会做大量小决策(是否再搜索、选哪个工具、信息是否充分等)
- 可从 LangSmith、Langfuse 或 OpenTelemetry 导入 agent 运行 trace,逐步展示执行过程并标出值得审查的决策点
- 用户选择要测试的决策点后,可对比原方案与用小模型运行的测试结果
- 不改动生产环境 agent;导入与审查 trace 无需调用模型
- 作者类比将其视为类似 DSPy GEPA 的基于 trace 的优化器
「编程与Agent」频道最新
- Codex 建应用很能干,连 Chrome 现有会话却频繁掉链子 — ChrisGPT · 2026-09-28
- DeepSeek 发布 Codex 式 Agent 框架,可接入多家模型供应商 — ChrisUniverse · 2026-09-28
- 用 Claude Code 打造菜单栏 Agent 应用 CoIsland,35+ 连接器监控开发工具 — DonTizi · 2026-09-28
- Andrew Carr 称用 Astra 跑出哈希一致的可复现输出 — andrew_n_carr · 2026-09-28
- SkillGym 用 2756 个技能环境微调,Qwen3.5 小模型超 Claude Sonnet 4.6 — dair_ai · 2026-09-28
- Coinbase CEO:每个后端服务都该有 /feedback 端点让 agent 反馈 — pzakin · 2026-09-28