Grok 4.6智能体基准测试登顶并列第一

在Artificial Analysis的AA-Briefcase智能体知识工作基准测试中,xAI的Grok 4.6表现亮眼,不仅得分逼近Claude Fable 5,更与Claude Opus 5 Max并列登顶第一。该模型在工具调用、规划和长程复杂任务方面展现出强大的自主性。此外,其单次任务成本仅为顶尖竞品的五分之一,兼具高性能与低成本优势。

2026-08-12 ~ 2026-08-13 · 4 条相关

事件全程(共 10 集)→