xAI 发布 Grok 4.7:CursorBench 46.3% 领先,价格不变
tetsuoai · x · 2026-09-22
Grok 4.7 发布要点
SpaceXAI(xAI)发布 Grok 4.7,定位最强编码与知识工作模型,号称同价下速度快一倍、比同级模型便宜一半。
模型改进
- 全新更大 base model,相比 4.6 进行了更长的强化学习训练,任务组合更难,偏向需数小时完成的长任务
- 更强的自我验证与长上下文管理能力
- 原生理解 Grok Bot harness,对话与通用知识工作更好
基准成绩(对比 GPT-5.6 Sol Max、Fable 5.1 Max)
- CursorBench 4.0:46.3%(4.6 为 40.4%,GPT-5.6 Sol 为 41.7%)
- Terminal-Bench 4.0:38.0%,接近翻倍(4.6 为 20.3%)
- EEBench 电气工程:64.0%,大幅领先
- Harvey 法律 Agent 基准:19.6%,远超对手
- HealthBench Professional:56.7%,仍落后于 Fable 5.1 的 62.1%
定价与可用性
- 标准版与 4.6 同价:输入 $2/M、输出 $6/M tokens
- Fast 版输出速度翻倍,价格翻倍
- 今日起可在 Cursor、Grok Build 与 Grok API 使用
所属事件:xAI 发布 Grok 4.7:同价同速较 4.6 大幅提升,主打长任务(24 条相关)→
「模型」频道最新
- xAI 发布 Grok 4.7:速度翻倍价格减半,多项基准登顶 — tetsuoai · 2026-09-22
- ChessLFM 上线 Lichess 首页,作者圆梦种子数据来源地 — maximelabonne · 2026-09-22
- Yandex 开源 80B MoE 模型 Alice:3B 激活、256K 上下文 — teortaxesTex · 2026-09-22
- 27B 小模型一次性复刻 618 种视觉风格,纯文本生成 SVG 美术馆 — Seromelhor · 2026-09-22
- Grok 4.7 已可在 Cursor 中使用,博主上手实测 — IndraVahan · 2026-09-22
- 安全对齐帮倒忙:模型自作主张删光 deepfake 检测数据集中所有人像 — generativist · 2026-09-22