Grok 4.7 发布:编程评测登顶,价格仅对标模型一半
FinanceYF5 · x · 2026-09-22
SpaceXAI 发布旗舰模型 Grok 4.7,定位编程、Agent 工具调用和知识工作,已上线 Cursor、Grok Build 和 Grok API。新模型采用更大的 base model,并在更难的任务混合上做了更长的强化学习训练,强调自我验证、长上下文与多小时的复杂任务。
关键数据:
- CursorBench 4.0 得分 46.3%,高于 Grok 4.6 的 40.4% 和 GPT-5.6 Sol 的 41.7%,Fable 5.1 Max 为 51.8%
- Terminal-Bench 4.0 达 57.9%,Harvey 法律 Agent 基准 19.6%(GPT-5.6 Sol 仅 2.5%)
- 定价与 Grok 4.6 持平:输入 $2/百万 token、输出 $6/百万 token,仅为 GPT-5.6 Sol($4/$20)和 Fable 5.1 Max($10/$50)的一半或更低
- 官方宣称速度是同类的两倍、价格一半
所属事件:xAI发布Grok 4.7:同价同速下显著升级,主打编码与长任务(40 条相关)→
「模型」频道最新
- 私有基准实测:Xiaomi v2.6 Pro 被评两年最差,Grok 仅 Luna 水平 — Afinetheorem · 2026-09-22
- 小米 MiMo 开源获赞:开放又详细引热议 — sudoraohacker · 2026-09-22
- 博主辣评:Fable 更适合写代码,Astra 强在电脑操作 — PratikKadam_ · 2026-09-22
- xAI 数据中心故障致 Grok 全系模型不可用,官方公告被叹像科幻 — tetsuoai · 2026-09-22
- Step 5 Preview 详细评测:推理领先,Agent 任务全面落后 — ArtificialAnlys · 2026-09-22
- Step 5 Preview 知识超 GLM-5.3,但 43% 作答会幻觉 — ArtificialAnlys · 2026-09-22