开源 KORA Doctor:揪出 Agent 运行中本不该发生的模型调用
NervousPengwin · reddit · 2026-10-07
作者指出 agent 可观测性目前只回答“调了什么、花了多少 token、成本多少”,却没有回答更关键的问题:哪些模型调用根本不该发生? 受 AUDR 基准启发,他开源了 CLI 工具 KORA Doctor(Apache-2.0),用于审计 agent 运行轨迹中的浪费。
目前检测的问题包括:
- 同一次运行内的重复推理
- 错失缓存或复用机会
- 把确定性工作交给 LLM 处理
- 用昂贵模型干简单活
- 过度编排与规划
作者坦承局限:AUDR 不含 prompt 原文,仅靠元数据无法证明两次调用语义相同,因此工具输出的是“待人工核查的候选”而非定论。一位生产环境从业者的反馈还指出,最大的浪费来源其实不是重复模型调用,而是多步骤间反复重新拉取同一份工具数据——说明部分浪费在模型调用发生之前就已产生。
「编程与Agent」频道最新
- 自制 AI「废物炮」:一条内容总成本仅 0.38 美元 — tobowers · 2026-10-07
- 用聊天驱动持久 LFE 内核,作者开源 jiti-lfe 复刻 REPL 智能体 — arthurcolle · 2026-10-07
- 开发者用 Jev AI 驱动六角色虚拟村庄,探索性格一致性平衡 — Zazzen · 2026-10-07
- 开发者用 vmpal 在虚拟机里装 Windows 11,自嘲玩大了 — DanielLockyer · 2026-10-07
- 免费 Agent 记忆资源库上线:11 个教程从入门到离线边缘部署 — Al_Grigor · 2026-10-07
- 微软开源 MiniCorp:用办公室模拟器造企业级智能体数据 — microsoft · 2026-10-07