按推理步骤决定何时检索
thisguyknowsai · x · 2026-07-11
这条讲 Technique 4:Retrieval Timing Control(检索时机控制)。
作者建议不要只在任务开始时检索一次,而要在每个推理步骤都判断:当前这个子问题是否已经有足够上下文。如果够,就不再检索;如果不够,再补一次。
据称,这种做法让多跳问题的平均 token 使用量降低了 41%。
所属事件:RAG系统进阶指南:解决上下文污染的八大工程技巧(20 条相关)→
「编程与Agent」频道最新
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用 prompt 造硬件:一次对话让智能体组装定制设备寄到家 — paraschopra · 2026-09-11
- 模型之外才是关键:一文拆解 RAG 到多智能体的六大 AI 架构 — goyalshaliniuk · 2026-09-11
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11