Parallel 发布智能体搜索能力排行榜:GPT-6 夺冠,DeepSeek 搜索提升最大
rickasaurus · x · 2026-09-19
Parallel(parallel.ai)推出 Search Capability Leaderboard,评估各大模型在智能体搜索场景中的表现,包括答案质量、成本以及联网搜索带来的能力提升,用于帮助开发者为搜索密集型工作流选型。
榜单亮点:
- GPT-6 (Astra):搜索智能分最高(70.3),适合需要复杂推理和最高准确率的任务;
- GPT-5.6 Luna:性价比最高(每千次任务约 $23.0),成本仅为榜首模型的 1/13;
- DeepSeek V4.1 Flash:从联网搜索中获益最大(提升 +45.0),是搭配搜索后进步最明显的模型;同时拿下搜索效率银牌和搜索智能铜牌。
该榜单使用标准及专有基准,评估模型编排搜索、综合结果给出正确答案的能力。Parallel 同时发布了面向智能体的低价快速网页搜索 API「Parallel Search Fast」。
「编程与Agent」频道最新
- OpenClaw 推出多人协作模式,解决 AI Agent「人类代理」痛点 — heyneighbor · 2026-09-19
- Computer-use agents 不等于 GUI agents:点击只是用电脑的一种方式 — DhruvBatra_ · 2026-09-19
- Muse 智能体真实代订机票,全程无差错完成 — alexandr_wang · 2026-09-19
- browser use 成大宗货:无护城河,头部网站自建 agent 工具将取代 — tedddyoweh · 2026-09-19
- 用 TypeSafe Jev 做 Flue 智能体的类型化路由器 — irvinebroque · 2026-09-19
- Agent 框架 Flue 发布 2.1:工具超时、MCP 注解等更新 — irvinebroque · 2026-09-19