Grok 4.6 追平 Claude Opus 5,并列 Agentic Index 第一
elonmusk · x · 2026-08-21
据 Artificial Analysis 数据,Grok 4.6(High)在 Agentic Index 上拿到 59 分,与 Claude Opus 5(Max)并列第一,领先其他主流模型。该指数聚焦真实世界智能体能力:工具使用、规划、自主性与复杂问题求解。这一成绩与 Grok 向 Grok Build、Grok Bot 等 agent 产品线的扩张相互呼应。(转述消息,分数以官方为准)
所属事件:Grok 4.6 追平 Claude Opus 5 并列 Agentic 榜首(2 条相关)→
「模型」频道最新
- 马斯克确认:团队正致力于提升 Grok 的写作技能 — mark_k · 2026-08-21
- 为何「全通过率」是个糟糕的评测指标? — xeophon · 2026-08-21
- ARC Prize 上线模型对比功能,Gemini 3.7 Flash 曝光高分 — mhmazur · 2026-08-21
- Anthropic Fable 放宽过滤后刷新 RareBench 记录 — danielmckinn0n · 2026-08-21
- NVIDIA 详解 Omni-Model:单一架构通吃文本图像视频与动作 — NVIDIA Developer · 2026-08-21
- 监测显示 Claude Opus 近期行为出现显著变化 — altryne · 2026-08-21