结合对话历史做重排
thisguyknowsai · x · 2026-07-11
这条讲 Technique 3:Context-Aware Reranking(上下文感知重排)。
常见流程是先召回 top-10 再全部喂给模型;这里的改进是用一个轻量重排器,结合完整对话历史而不是只看当前 query 来给 chunk 打分。与前文冲突的内容会被降权,能延续上下文的内容会被提权。
作者称,这样能让最终输出中的矛盾减少 28%。
所属事件:RAG系统进阶指南:解决上下文污染的八大工程技巧(20 条相关)→
「编程与Agent」频道最新
- 零基础开发者自建分层记忆架构,仅 20k token 记住一年对话 — matteoianni · 2026-09-11
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 九年后端老兵:AI 代码不比人写的差,变糟的只是速率 — Sweaty-Landscape-561 · 2026-09-11
- 实测质疑 RTK 省 token 说法:成本基准显示并不成立 — michalwarda · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11