xAI 官宣 Grok 4.7:同价提速,CursorBench 46.3%,Harvey 法律基准大涨
SpaceXAI · x · 2026-09-22
SpaceXAI 官方发布公告,推出 Grok 4.7——其最强编码与知识工作模型,宣称速度为同类两倍、价格一半,实际定价与 Grok 4.6 持平(输入 $2/百万 token、输出 $6/百万 token)。
模型改进
- 全新更大基础模型,针对耗时数小时的难题做更长 RL 训练
- 更强自我验证与长上下文管理
- 原生理解 Grok Bot 系统,改善对话与知识工作
关键基准(vs 4.6 / GPT-5.6 Sol / Fable 5.1)
- CursorBench 4.0:46.3% / 40.4% / 41.7% / 51.8%
- DeepSWE v1.1:71.0% / 65.2% / 72.7% / 70.0%
- EEBench:64.0% / 53.0% / 39.4% / 56.4%
- AA Briefcase v1.1:1,657 / 1,546 / 1,487 / 1,678
- Terminal-Bench 4.0:38.0% / 20.3% / 37.3% / 57.9%
- Harvey 法律基准:19.6% / 15.8% / 2.5% / 6.7%
- HealthBench Professional:56.7% / 48.5% / 60.5% / 62.1%
在 CursorBench 上处于同价位的性价比前沿。现已在 Cursor、Grok Build 和 Grok API 上线。
所属事件:xAI 发布 Grok 4.7 主打编码与长任务(26 条相关)→
「模型」频道最新
- Azure OpenAI 内容过滤器闹乌龙:把「S&M」当成色情内容拦截 — peterjliu · 2026-09-22
- IFM 发布 K2-Horizon-36B-A4B:MoVA 新架构以 4B 激活参数对标大 20 倍模型 — victormustar · 2026-09-22
- Grok 4.7 又翻车:花 $1.59 输出惨不忍睹,遭全网围观 — teortaxesTex · 2026-09-22
- 实测打脸:1000 条诈骗广告分类,拟合 TF-IDF 基线完胜 LLM — justinbiebar · 2026-09-22
- Evo 2 模型内部竟编码「生命之树」:激活流形对应物种演化关系 — burny_tech · 2026-09-22
- 内部实测:Grok 4.7 在 22 项知识工作中排第 3,成本低于 5 美元 — realsohamparekh · 2026-09-22