Grok 4.5 登顶 HighWalk,代码变更规格更新能力居首

elonmusk · x · 2026-07-29

转发内容称,Grok 4.5(high)在 HighWalk benchmark 上拿到第一,HighWalk 主要测试 AI agent 根据代码变更更新技术规格的能力。

配图显示,Grok 在质量和运行效率的组合指标上领先 Claude 和 GPT,位列榜首。

所属事件:Grok 4.5 登顶 HighWalk 基准测试(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →