没有评估就是盲建:上下文嵌入模型需对消歧上下文块也高排序

antoine_chaffin · x · 2026-10-01

Antoine Chaffin 强调评估的重要性:没有评估就是在盲建,做好评估很难,需要大量努力才能摆脱常见偏差、评估新能力。与 @n0riskn0r3ward 的讨论让他们重新审视模型和方法中哪些有效、哪些无效,认为长期看值得投入。

被引用的 @n0riskn0r3ward 分享了上下文嵌入模型的使用心得:自 voyage-context-3 发布后开始使用并做基准测试,发现对长文档而言,不仅要对答案块高排序,还要对消歧上下文块高排序。做得好可让搜索 agent 只读文档相关部分而非每一页。他因此开始测量这一点,并主动向 Perplexity 团队分享基准结果——并非所有建模团队都愿意接受第三方反馈,但 Perplexity 团队很积极。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →