Grok 4.5 登顶 HighWalk,代码变更规格更新能力居首
elonmusk · x · 2026-07-29
转发内容称,Grok 4.5(high)在 HighWalk benchmark 上拿到第一,HighWalk 主要测试 AI agent 根据代码变更更新技术规格的能力。
配图显示,Grok 在质量和运行效率的组合指标上领先 Claude 和 GPT,位列榜首。
所属事件:Grok 4.5 登顶 HighWalk 基准测试(2 条相关)→
「模型」频道最新
- 用户称 GPT-5.6 Pro 像代码审查和抓虫终结者 — dejavucoder · 2026-07-29
- 从 GPT-2 到 KimiK3:这篇文章说不只是尺度变大 — algo_diver · 2026-07-29
- 用户称 Anthropic Opus 5 个性化后变得几乎不可读 — himanshustwts · 2026-07-29
- Scobleizer 称 Grok 4.5 是当前最强编程模型 — Scobleizer · 2026-07-29
- Apple 据称起诉 OpenAI,指控未来硬件相关商业秘密被盗用 — emmanuelvivier · 2026-07-29
- Kimi K3 和 Qwen3.8 证明中国 AI 已成持续竞争力量 — emmanuelvivier · 2026-07-29