Grok 4.6 智能体评测逼近 Claude Fable 5,单次任务成本仅其五分之一

ArtificialAnlys · x · 2026-08-13

在 Artificial Analysis 的 AA-Briefcase 智能体知识工作基准测试中,xAI 的 Grok 4.6 取得了显著进步,得分与 Anthropic 的 Claude Fable 5 不相上下。

该测试主要评估模型在长周期知识工作中的表现。值得注意的是,Grok 4.6 的单次任务成本仅为 4.42 美元,远低于 Claude Fable 5(22.30 美元)和 Claude Opus 5(17.79 美元),展现出极高的性价比。

所属事件:Grok 4.6 智能体评测登顶,性价比与第一梯队表现亮眼(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →