读优先POS智能体复盘:缓存命中率近零,写入操作暂缓
RedaHaloubi · reddit · 2026-09-17
作者复盘其只读 POS 分析智能体(route → fetch → narrate → ground,Node/TS + Vercel AI SDK)的迭代:采纳社区意见暂缓 HITL 写入路径,在读取环路收敛前不加入可变更工具,并落实 pin 语义、CORE 优先 schema、基于 traces/fetch/步数/DTO 覆盖率的评估。
模型与成本:开发环境用 Gemini 2.5/3.5 Flash Lite,典型一次请求约 4,840 输入 token / 123 输出 token,2 步往返、2.3 秒;但 Gemini 隐式缓存命中率整体仅 2.2%,当前 CORE-12 与 pin 请求均为 0%,说明前缀理论上可缓存但实际未命中,因此未增加第二跳模型调用。
作者还提出两个待解问题:日期歧义时是用 UI 中断暂停让用户选择,还是默认时间窗并在首句说明;以及双语(EN+FR)路由是否用同组正则的同义词条目表而非翻译路由。
所属事件:只读POS分析智能体复盘:缓存命中率仅2.2%,写入功能暂缓(2 条相关)→
「编程与Agent」频道最新
- iMessage 智能体 Rene 发布:发条短信就能替你追账收钱 — EXM7777 · 2026-09-17
- 单人 7 周用 AI 做出全 AI 生成 C++ 游戏 STARBATTLE — AIandDesign · 2026-09-17
- 把标签页、文件和终端按项目分组滑动切换,开发者晒自用工具 — nateparrott · 2026-09-17
- Google AI Studio 新技巧:用 generate_image 让 app 不再「Vibe 味」 — m4rkmc · 2026-09-17
- 腾讯内部用半年后开源 TeamAI-CLI:团队知识变 git 仓库供 agent 共享 — Roger_M_Taylor · 2026-09-17
- 爱丁堡等团队提出 RoMem:用相位旋转处理过期知识,时序推理提升 2-3 倍 — Roger_M_Taylor · 2026-09-17