Grok 4.6 登顶智能体评测,成本仅 Claude 竞品一半
elonmusk · x · 2026-08-18
Elon Musk 转发数据称 Grok 4.6 在 Artificial Analysis Agentic Index 中夺得第一,与 Claude Opus 5 Max 并列 59 分。该指数侧重衡量工具使用、规划及复杂问题求解能力。数据显示,Grok 4.6 完成任务平均仅需 53 轮对话和 5 亿输入 token,而 Claude 需 103 轮和 20 亿 token。Grok 的单任务成本为 0.84 美元,在智能与性价比上达到最优平衡。
所属事件:Grok 4.6 登顶 Agent 评测榜,成本远低于竞品但套餐遭吐槽(3 条相关)→
「编程与Agent」频道最新
- Zig 从零写的机器浏览器 Lightpanda 1.0 正式发布 — jedisct1 · 2026-10-02
- dfinke 发布 PowerShell 模块,封装 Perplexity Decisions API — dfinke · 2026-10-02
- gemini-cli 修复点号版 Gemini 3 模型多模态工具输出 400 报错 — bodapatisaikrishna · 2026-10-02
- Cloudflare 推出 Web Search API:给 Agent 一个真正会搜索的浏览器 — Cloudflare Blog · 2026-10-02
- Opus 5.5 让 computer use 好用,擅长网页表单等非 CLI 繁琐任务 — DimitrisPapail · 2026-10-02
- 人类注意力难扛零上下文审查,他重造 IDE 迎战 AI 代码 — arpit_bhayani · 2026-10-02