Omnigent 四道防线治理 LLM 账单,智能路由拦截昂贵模型滥用
matei_zaharia · x · 2026-10-07
Terry Tang Yuan 在 Omnigent 博客中详解如何防止多智能体或调试会话悄悄烧掉 LLM 预算。核心问题是 LLM 成本随 token 消耗而非交付量增长,长对话上下文与多 agent 工作流会放大开销,多数团队只在账单出来后才发现。
Omnigent 在四个环节控制成本:
- 预防:智能路由用轻量 LLM 把用户消息分类为 TRIVIAL/COMPLEX,琐碎消息(事实查询、问候、单行改动、短问答)被禁止路由到 Opus、GPT-5 等昂贵模型,配置只需声明 denytrivialtoexpensivemodel 策略。
- 控制:渐进式预算先警告、后阻断,触顶时降级到便宜模型而非直接中断任务。
- 可见性:Usage 页面按模型、harness、会话拆解 token 花费,支持自托管模型的自定义定价。
- 保险:thrashing 检测、定时任务限额、终端操作审批。
作者建议分阶段落地:先开可见性,再上路由,最后启用预算。
「编程与Agent」频道最新
- Decisions API 公测:屏幕感知快捷操作让 CUA 任务快约 10 倍 — stevenheidel · 2026-10-07
- 别再从基础学起:先动手建项目,失败后再补课,唯独 Git 得先学 — brandon_galang · 2026-10-07
- Agent 执行真实操作时,审批过期怎么办?生产环境治理难题 — Goberians1 · 2026-10-07
- 开源 Dragon IDE:CodeOSS 底座 + OpenCode agent 团队互相对话 — DragonBallerZzz · 2026-10-07
- Monid 获 770 万美元融资,要做 Agent 工具版 OpenRouter — SimplyAnnisa · 2026-10-07
- Actual 发布汇编级 tokenizer toks:比 Hugging Face 快达 151 倍 — markjeffrey · 2026-10-07