Octen Search 搜索评测排名第三:16.9 秒最快,成本仅 0.058 美元/任务
ArtificialAnlys · x · 2026-09-11
Artificial Analysis 用统一方法论(固定基座模型跑在其开源 agent 框架 Stirrup 中,仅更换搜索工具)评测了 Octen AI 的 Octen Search:
- 综合排名第三:Search Index 得分 77,仅次于 Perplexity Search(medium, 80)与(high, 79),与 Perplexity(low)持平;BrowseComp 上拿 86 分,仅距榜首 1 分;DeepSearchQA 得 80 分;AA-Omniscience 66 分则落后于 Firecrawl(73)
- 速度最快:单次查询平均 0.2 秒,比 Perplexity 变体(1.0–1.2 秒)快约 5 倍;单任务耗时 16.9 秒,为全场最低,甚至低于纯模型基线的 22.6 秒
- 成本极低:1 美元/千次查询(标准价 5 美元打了 8 折),每任务搜索 6–12 次,约合每任务 9 美元;模型成本约 49 美元/千任务。综合每任务 0.058 美元,处于"质量-成本"Pareto 前沿,介于 TinyFish(0.035 美元/71 分)与 Perplexity medium(0.091 美元/80 分)之间
所属事件:Octen Search 获 Artificial Analysis 搜索评测第三名(2 条相关)→
「编程与Agent」频道最新
- Ollama 新功能:ChatGPT 模型选择器可自定义,本地与云端模型任选 — ollama · 2026-09-11
- ChatGPT Codex 桌面端现已可接入 Ollama 本地模型,升级 0.34 即用 — ollama · 2026-09-11
- Inspect 评测默认续写提示词可能误导 Agent 恶化行为 — AdtRaghunathan · 2026-09-11
- Claude Code 作者公开回复:AI 写的生产代码该比人写要求更高 — bcherny · 2026-09-11
- 中文开发者感慨:有人一天烧完 Codex 周额度,有人从未用过 — yihui_indie · 2026-09-11
- 「Modern Context Stack」讽刺网站爆火:别再买工具,去对齐干系人 — juansequeda · 2026-09-11