xAI 发布 Grok 4.7:编程与知识工作旗舰,价格仅竞品几分之一
tetsuoai · x · 2026-09-22
xAI 正式发布 Grok 4.7,定位最强编程与知识工作模型,价格与速度与 Grok 4.6 持平(输入 $2/百万、输出 $6/百万),仅为同类竞品的几分之一。
关键信息
- 更大的新 base model,更长的 RL 训练,任务难度更高、偏向需数小时完成的问题;自我校验与长上下文管理更强;原生适配 Grok Bot harness。
- 跑分:CursorBench 4.0 达 46.3%(Grok 4.6 为 40.4%,GPT-5.6 Sol 41.7%,Fable 5.1 max 51.8%);DeepSWE v1.1(high effort)71.0%;Terminal-Bench 4.0 38.0%;Harvey 法律基准 19.6% 大幅领先;EEBench 64.0%。
- 官方称在强调长时程编程任务的 CursorBench 4.0 上性价比处于前沿,文档与演示生成能力也有提升。
- 宣称速度翻倍、价格约为同类模型一半,安全护栏为迄今校准最好的一版。
用户可通过终端运行 grok update 更新 Grok Build 体验。
所属事件:xAI 发布 Grok 4.7:同价提速,基准大幅跃升(15 条相关)→
「Infra」频道最新
- 从朴素实现到共享内存分块:一篇 CUDA GEMM 提速实战全记录 — abhijithneil · 2026-09-22
- AMD 发布 Helios GPU 教学 GEMM 调优指南:432GB HBM4、23TB/s 带宽实测 — simran_s_arora · 2026-09-22
- 能力涨价的另一面:Grok 4.7 每任务消耗 81k token,超对手两倍 — ArtificialAnlys · 2026-09-22
- 做抽屉拉手起家:King Slide 四年涨 3000% 成 AI 隐形赢家 — CatAstro_Piyush · 2026-09-22
- AMD 市值突破万亿美元,昔日黑马正式跻身万亿俱乐部 — Beth_Kindig · 2026-09-22
- vLLM 推出 Hybrid KV Cache Manager,补齐混合架构推理短板 — TheZachMueller · 2026-09-22