Grok 4.5 接入 Perplexity 编排系统并登顶 WANDR 评测

近期,xAI 的 Grok 4.5 正式接入 Perplexity 系统,成为 Perplexity Computer 面向 Consumer Pro/Max 订阅用户提供的编排模型。这一动态不仅标志着两家公司在产品层面的深度整合,也因 Grok 4.5 在内部基准测试中展现出的压倒性优势而备受关注。

评测数据与表现

在 Perplexity 的 WANDR 基准测试中,Grok 4.5 与另外 5 种编排配置进行了对比。结果显示,Grok 4.5 拿到了 0.328 的最高分,成为表现最强的前沿模型,其单次试验成本约为 4.76 美元。Perplexity 的 Arav Srinivas 对其表现印象深刻,而 Elon Musk 则强调,Grok Build 和 Grok 4.5 最大的价值在于它们在真实工作场景中“确实非常有用”。

实际应用反馈

在真实用户体验方面,用户 @BWay124 对搭载 Grok 4.5 (High) 的 Grok Build 进行了实测。该用户指出,Grok Build 达到了全新高度,能够适应任何终端、项目或代码库环境。只需输入目标并解除障碍,它即可自主完成后续工作,例如首次顺畅地通过自主 CLI 操作执行数据库修改和查询等任务。同时,该用户也建议未来能支持跨终端或代码库无缝恢复对话,以便在不同层级间更好地工作。

2026-07-11 ~ 2026-07-12 · 10 条相关

事件全程(共 20 集)→

一手来源

另有 1 条近重复转述:rohanpaul_ai