Grok 4.5成最佳编排器
rohanpaul_ai · x · 2026-07-12
【转发】Perplexity Computer 的编排器测试里,Grok 4.5 成为表现最强的 orchestrator,在 WANDR 基准上拿到 0.328 分,单次试验成本约 $4.76。
对比中:
- Opus 4.8 (high, thinking):0.254,成本 $9.46
- GPT-5.6 sol (medium):0.289,成本 $2.64
WANDR 主要衡量需要搜索、多步推理、计算、去重、证据核查和结构化输出的复杂研究任务。Perplexity 的 Computer 会把研究、编码、浏览和文档工作分配给多个子 agent。此次评测显示,Grok 4.5 在 5 组配置中分数最高,且成本约为 Opus 4.8 的一半。
所属事件:Grok 4.5 接入 Perplexity 编排系统并登顶 WANDR 评测(10 条相关)→
「编程与Agent」频道最新
- Fable 5.1 生成 three.js 网站实测:快且精准,但细节仍需人把关 — repligate · 2026-09-03
- SentinelX 开源:让 LLM 安全接管你的 Linux 服务器终端 — CarolusX74 · 2026-09-03
- 连载 30 天:用 fable 5.1 给户外机器人写出无线手柄控制器 — _Stocko_ · 2026-09-03
- 试水 AmpCode:可用 ChatGPT 订阅、每线程一台云电脑,槽点是吉祥物 Puck — carlosdponx · 2026-09-03
- 一人一 Agent 独立 microVM:语言学习产品上线生产环境的三个教训 — maritime_sh · 2026-09-03
- 断网手写 10 页文档后让 Agent 做成 PPT:作者发现自己文字像 AI 糊弄产物 — cnakazawa · 2026-09-03