Grok 4.5在评测中拿到最高分
AravSrinivas · x · 2026-07-11
Grok 4.5 被 Perplexity 作为 Computer 的 orchestrator 模型上线后,在 WANDR 评测中拿到所有前沿模型里最高分。
他们把它和另外 5 种 orchestrator 配置对比,结果显示它的分数高于所有其他配置,成本大约只有 Opus 4.8 的一半。
所属事件:Grok 4.5 接入 Perplexity 编排系统并登顶 WANDR 评测(10 条相关)→
「编程与Agent」频道最新
- 开发者发问:现在还该用 LangChain 还是自建 agent 框架? — curious_vii · 2026-09-03
- 推理工程吃香:vLLM/SGLang 搭副本加缓存路由核心配方 — GabGarrett · 2026-09-03
- 开发者误打误撞用 Fable 5.1 搭出一座「智能体工厂」 — 0xkarasy · 2026-09-03
- 微软新法:Foundry 智能体可经 Fabric IQ 调用 Fabric 数据智能体 — adnan_hashmi · 2026-09-03
- Databricks 在 VLDB 2026 主推 agent 原生数据基础设施 Lakebase — matei_zaharia · 2026-09-03
- doodlestein 沉淀数月经验,发布 Web 应用综合审查 Skill — doodlestein · 2026-09-03