Grok 4.5 在新 HighWalk 基准上拿下第一
elonmusk · x · 2026-07-29
- 这条转发称 Grok 4.5 在一个新基准 HighWalk 上拿到了第一。
- 该基准据称用 46 个 Laravel commits 测试模型能否更新真实技术规格,重点考察代码分析、抽象能力和精确写作。
- 配图里的结果显示:Grok 4.5 (high) 综合质量与效率最佳排第一;Claude Opus 5 (high) 原始质量最高且没有硬失败;GLM 5.2 被标为最强开源权重模型。
- 图中还提到,提升 reasoning effort 并不总能带来更好结果。
所属事件:Grok 4.5 登顶 HighWalk 基准测试(2 条相关)→
「模型」频道最新
- Laguna s2.1上线一周后仍被指循环失控、工具调用翻车 — Possible_Grocery8079 · 2026-07-29
- 用户称 GPT-5.6 Pro 像代码审查和抓虫终结者 — dejavucoder · 2026-07-29
- 从 GPT-2 到 KimiK3:这篇文章说不只是尺度变大 — algo_diver · 2026-07-29
- 泄露视频称 Gemini 4 或临近发布,展示物理与动画演示 — WorldofAI · 2026-07-29
- 用户称 Anthropic Opus 5 个性化后变得几乎不可读 — himanshustwts · 2026-07-29
- Scobleizer 称 Grok 4.5 是当前最强编程模型 — Scobleizer · 2026-07-29