Grok 4.7 发布:价格不变,Terminal-Bench 成绩从 20.3% 翻倍至 38%
FinanceYF5 · x · 2026-09-22
xAI 发布 Grok 4.7,在保持与 Grok 4.6 相同价格和速度的前提下整体能力提升:API 价格仍为每百万输入 token 2 美元、输出 6 美元,上下文窗口 50 万 token。官方称新模型能在高难度任务上持续工作更久、更仔细地检查结果,并配备「目前最强的安全防护」。对比 Grok 4.6 的评测提升明显:CursorBench 4.0 46.3% vs 40.4%,DeepSWE v1.1 71.0% vs 65.2%,EEBench 64.0% vs 53.0%,Terminal-Bench 4.0 38.0% vs 20.3%。还有视频对比两代模型构建开放世界城市游戏的效果,可直接观察复杂项目上的差距。
所属事件:xAI发布Grok 4.7:同价同速下显著升级,主打编码与长任务(40 条相关)→
「模型」频道最新
- 私有基准实测:Xiaomi v2.6 Pro 被评两年最差,Grok 仅 Luna 水平 — Afinetheorem · 2026-09-22
- 小米 MiMo 开源获赞:开放又详细引热议 — sudoraohacker · 2026-09-22
- 博主辣评:Fable 更适合写代码,Astra 强在电脑操作 — PratikKadam_ · 2026-09-22
- xAI 数据中心故障致 Grok 全系模型不可用,官方公告被叹像科幻 — tetsuoai · 2026-09-22
- Step 5 Preview 详细评测:推理领先,Agent 任务全面落后 — ArtificialAnlys · 2026-09-22
- Step 5 Preview 知识超 GLM-5.3,但 43% 作答会幻觉 — ArtificialAnlys · 2026-09-22