Artificial Analysis 发布搜索 API 基准:Parallel、Exa 表现最佳
ArtificialAnlys · x · 2026-08-19
Artificial Analysis 推出了搜索 API 基准测试,评估了各提供商在质量、成本和速度方面的表现,以辅助开发者选择 Agent 用的搜索工具。初始覆盖 Parallel、Exa、Firecrawl、You.com、Tavily 等七家提供商。
测试方法:
- 使用同一模型 GPT-5.6 Luna (medium) 在 Stirrup 开源 Agent 框架中运行。
- 仅更换搜索工具背后的提供商,其余条件一致。
- 综合评分由 DeepSearchQA、BrowseComp 和 AA-Omniscience 三个基准平均得出。
关键结论:
- 头部表现:Parallel、Exa 和 Firecrawl 综合得分最高(75、74、73)。
- 显著提升:所有搜索提供商均大幅提升了模型的知识基准表现(模型仅得 33 分,搜索辅助后得分 65-75)。
- 成本权衡:高质量的搜索结果能减少模型推理的 Token 消耗(Parallel 高级版比基础版节省 40% 以上 Token),从而抵消较高的搜索 API 费用。
所属事件:Artificial Analysis 发布搜索 API 基准,Parallel 与 Exa 领先(3 条相关)→
「编程与Agent」频道最新
- DataSmith 智能体聚焦数据研究,平均分超 Claude Code — soumitrashukla9 · 2026-08-19
- AWS AI League 回归:72 小时微调模型并部署 Agent,区域冠军直通 re:Invent 总决赛 — ruchi798 · 2026-08-19
- AI Agent 持有 GitHub 凭证后,Star 指标或失真 — saranormous · 2026-08-19
- Agent 生态爆发:技能库与工具链成新主流 — saranormous · 2026-08-19
- GitHub 项目 Caveman 激增:Token 压缩受热捧 — saranormous · 2026-08-19
- 开发者呼吁现代版代码浏览器以审查 AI 生成代码 — braelyn_ai · 2026-08-19