Grok 4.7 专业工作评测反超 GPT-6 Astra,领先超 150 Elo

XFreeze · x · 2026-09-22

在 Artificial Analysis 的同一轮评测中,Grok 4.7 在专业交付物基准 GDPval-AA 上领先 GPT-6 Astra 达 +153 Elo,在多小时办公任务基准 AA-Briefcase 上领先 +88 Elo。

这意味着 Grok 4.7 已在「专业级工作产出」和「长时间办公任务」两类评测上同时占优。发帖人称 SpaceXAI 正在把 Grok 强力推向真实世界的知识工作场景。

所属事件:Grok 4.7 评测:智能指数进前四,成本仅 Opus 一半但 token 翻倍(16 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →