读优先POS智能体复盘:缓存命中率近零,写入操作暂缓

RedaHaloubi · reddit · 2026-09-17

作者复盘其只读 POS 分析智能体(route → fetch → narrate → ground,Node/TS + Vercel AI SDK)的迭代:采纳社区意见暂缓 HITL 写入路径,在读取环路收敛前不加入可变更工具,并落实 pin 语义、CORE 优先 schema、基于 traces/fetch/步数/DTO 覆盖率的评估。

模型与成本:开发环境用 Gemini 2.5/3.5 Flash Lite,典型一次请求约 4,840 输入 token / 123 输出 token,2 步往返、2.3 秒;但 Gemini 隐式缓存命中率整体仅 2.2%,当前 CORE-12 与 pin 请求均为 0%,说明前缀理论上可缓存但实际未命中,因此未增加第二跳模型调用。

作者还提出两个待解问题:日期歧义时是用 UI 中断暂停让用户选择,还是默认时间窗并在首句说明;以及双语(EN+FR)路由是否用同组正则的同义词条目表而非翻译路由。

所属事件:只读POS分析智能体复盘:缓存命中率仅2.2%,写入功能暂缓(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →