Grok 4.6 追平 Claude Opus 5,并列 Agentic 榜第一
XFreeze · x · 2026-08-21
Artificial Analysis 的 Agentic Index 上,Grok 4.6(high)与 Claude Opus 5(max)同为 59 分并列第一,超过 GPT-5.6 Sol 等对手。发帖人认为 agentic 能力(工具使用、规划、自主性与复杂问题求解)正成为最关键的基准维度,而 Grok 也是 Grok Build 与 Grok Bot 等需要实际执行任务的产品的底层模型。
「模型」频道最新
- Gemma 模型下载量突破 10 亿,社区应用广泛 — reach_vb · 2026-08-21
- Grok 4.6 追平 Claude Opus 5,并列 Agentic Index 第一 — elonmusk · 2026-08-21
- DeepSeek V4 Pro 跑分 KernelBench,逼近 Opus 5 — teortaxesTex · 2026-08-21
- Liquid AI 推出 DSpark 草稿模型,加速达 4 倍 — JosephJacks_ · 2026-08-21
- 用户反馈 Qwen Uncensored 仍频繁拒答 — BLUECOW009 · 2026-08-21
- Pander Score 榜单揭示主流模型阿谀奉承程度差异 — RobbWiller · 2026-08-21