Tavily 智能体可见性报告遭质疑:提问带域名才 93% 实时检索
edwin · x · 2026-10-09
Tavily 此前发布报告称,在 38,000 次任务、1,056 个真实商业网站的测试中,Claude Code、ChatGPT 等智能体推荐服务时 93% 的信息来自实时抓取而非训练知识;可被智能体读取的网站被推荐概率高 2.6 倍;屏蔽智能体后网络搜索占比翻倍,且答案 3.7 倍更可能遗漏全部关键事实。
edwin 指出该报告的方法论局限:所有测试提问都锚定了具体域名(如「{域名} 有哪些订阅方案及价格」),这种提示方式天然会引导智能体去实时抓取该网站,93% 的实时检索比例并不意外。而根据其自有数据(数百万次任务),若去掉域名提问,训练数据在回答中的权重会大得多。
「研究」频道最新
- 研究者公开点评可解释性论文:S1 与 S2 向量差异明显难整合 — rgblong · 2026-10-09
- 基因组 seq2func 工具包 tangermeme 登上 Nature Methods — anshulkundaje · 2026-10-09
- 测试时搜索用于抗体设计,成功率从16%跃升至78% — anshulkundaje · 2026-10-09
- aimotive 自动驾驶数据集训练标签靠「事后诸葛」追踪器生成 — RexDouglass · 2026-10-09
- Yale 研究发现 LLM 内部表征存在符号结构 — tallinzen · 2026-10-09
- COLM 2026 离散扩散 meetup:10 月 8 日 4-5 点 Grand Ballroom — yuntiandeng · 2026-10-09