Grok 4.6 登顶智能体评测,成本仅 Claude 竞品一半
elonmusk · x · 2026-08-18
Elon Musk 转发数据称 Grok 4.6 在 Artificial Analysis Agentic Index 中夺得第一,与 Claude Opus 5 Max 并列 59 分。该指数侧重衡量工具使用、规划及复杂问题求解能力。数据显示,Grok 4.6 完成任务平均仅需 53 轮对话和 5 亿输入 token,而 Claude 需 103 轮和 20 亿 token。Grok 的单任务成本为 0.84 美元,在智能与性价比上达到最优平衡。
所属事件:Grok 4.6 登顶智能体评测榜 成本远低于竞品(2 条相关)→
「编程与Agent」频道最新
- Hermes Desktop 发布 Bot Mode:多智能体协作新功能 — markjeffrey · 2026-08-18
- 开源 Tidebroker:为 Agent 提供安全凭证代理 — steipete · 2026-08-18
- 用 Grok 生成全代码打造金属机器狗,Three.js 模拟行走 — techartist_ · 2026-08-18
- Perplexity Computer 更新:支持手动干预工具 — AravSrinivas · 2026-08-18
- 强压 Codex 优化 10 小时,代码提速 200 倍 — josh_wills · 2026-08-18
- 设想:基于结构化文件系统的 LLM 长期记忆管理方案 — Orectoth · 2026-08-18