Grok 4.6 智能体榜单登顶,与 Claude Opus 5 Max 并列第一
XFreeze · x · 2026-08-13
Grok 4.6 在 Artificial Analysis 智能体指数中登顶,与 Claude Opus 5 Max 并列第一。该榜单主要评估大模型在工具调用、规划、自主性和复杂问题解决等智能体工作流方面的综合能力。
所属事件:Grok 4.6 智能体榜单登顶并比肩 Claude Opus(2 条相关)→
「模型」频道最新
- Cohere开源North Micro Vision小型视觉模型 — MaziyarPanahi · 2026-08-13
- 免费版 ChatGPT 限流策略:思考按钮用多会被静默降级 — Sauers_ · 2026-08-13
- 实机对比:Grok 4.6 成功率略胜 DeepSeek,但价格仍处下风 — vista8 · 2026-08-13
- Gemini Flash被指性价比不佳:性能不及Pro且成本高出4.5倍 — teortaxesTex · 2026-08-13
- DeepSeek Harness爆料:今日正式开启公测,构建插件生态 — teortaxesTex · 2026-08-13
- Grok 4.6 发布引争议,被指缺乏详细模型卡与安全测试 — Miles_Brundage · 2026-08-13