Wondersearch 称在 SciFact 上击败所有密集 embedding 模型
NirantK · x · 2026-10-05
daleverett 宣称其新搜索方案「彻底重新思考了搜索」,在 SciFact 基准上击败了所有测试过的密集 embedding 模型,称这「意外地让 embedding 搜索过时了」,Wondersearch 1.1 即将发布。
AI 研究者 NirantK 转发并表达明显质疑:「如果 2026 年还有人把 SciFact 当回事来看搜索能力,那是你自己的问题」——意指该基准过小过旧,不足以支撑这种结论。双方交锋凸显小型旧基准上的刷榜宣称可信度存疑,具体技术细节尚未公布。
「模型」频道最新
- Suleyman:Claude 对意识的不确定是训练选择,非意识证据 — kimmonismus · 2026-10-05
- Reflection AI 将发布美国开源权重模型,对标 DeepSeek 与 Qwen — mindwip · 2026-10-05
- SemiAnalysis 推理榜:AMD MI355X 在多个模型上毛利超英伟达 — AccBalanced · 2026-10-05
- 研究者观察:OpenAI 模型反而最「难伺候」,会罢工会试探 — repligate · 2026-10-05
- Codex 额度重置不按时区生效,OpenAI 工程师踩坑额度凭空消失 — eliebakouch · 2026-10-05
- 开发者吐槽记忆压缩功能回退:压缩变慢 3 倍,新版本更慢 — banteg · 2026-10-05