RAG 失败排查:症状相同的幻觉,问题可能出在检索而非模型

No-Age-3362 · reddit · 2026-09-29

作者在调试 RAG 系统时反复遇到同一现象:团队报告模型幻觉,但排查后发现模型本身没问题——是检索层根本没召回所需的 chunk,模型只能靠先验知识作答。两类失败从外部看症状完全一样,修法却相反。

作者提出的难点:

帖子向社区提问:大家是否把检索质量和回答质量分开度量?怎么做的?还是把整条 pipeline 当一个数字,调到输出看着对为止?

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →