Cursor 实测:Grok 4.6 性价比远超 Fable 5 Max
soleio · x · 2026-08-14
Cursor 团队的 Lauren 和 Roshan 在直播中分享了 xAI 新模型 Grok 4.6 在 CursorBench 3.2 基准测试中的表现,强调了其在成本效益上的巨大优势。
- 成绩对比:Grok 4.6 达到了 70.8% 的准确率,单任务成本仅为 $2.81;而 Anthropic 的 Fable 5 Max 准确率为 70.5%,单任务成本高达 $17.32。
- 团队观点:Lauren 指出,尽管自己作为员工可以无限消耗 token,但大多数用户对成本非常敏感。Grok 4.6 提供了一种极具吸引力的选择——它不仅达到了顶级大模型的智能水平,而且成本只是其零头,这直击了当前 AI 工程领域“使用成本高昂”的痛点。
「编程与Agent」频道最新
- 客服新范式:多级 AI 智能体接力解决复杂问题 — round · 2026-08-14
- Stanford 研究:多智能体协作成功率远低于单兵作战 — _Hao_Zhu · 2026-08-14
- 告别盲目堆 Token:Factory AI 推出智能体效能监测 — matanSF · 2026-08-14
- Mendel Gödel Machine:通过比较进化实现智能体自我改进 — burny_tech · 2026-08-14
- Coinbase CEO:用AI改造工作流必须颠覆旧习惯 — J0se · 2026-08-14
- Claude Code 实战:两月移植 21 万行 90 年代 C++ 代码 — moenig · 2026-08-14