Grok 4.7 发布首日:开发者实测口碑与极限用例齐飞
9 月 22 日 xAI 发布 Grok 4.7 后,首日即出现大量第三方实测反馈,整体口碑明显偏向正面,与部分「公开基准成绩不佳」的负面报道形成反差。
已确认
- 开发者 Matt Shumer 称 Grok 4.7 是「非常好用的日常主力模型」,较 4.6 是巨大进步。
- 开发者 ScriptedAlchemy 分享一周以上使用体验:围绕同一目标连续自主工作超过 70 小时,细节把控更好,50 万 token 上下文有效。
- 另有开发者报告 Grok 4.7 对 system prompt 的遵循度显著提升,认为基准分数和 3D 游戏演示都不能反映真实工作能力。
- 网友整理 10 个发布首日极限用例:包括用 Grok Bot 提升生产力、帮助企业捕获价值 14.6 万美元的错误、生成 Blender 场景、布料模拟、机械臂动画、单行提示词建模等。
- 有用户让 Grok 4.7 与 4.6 各自构建开放世界城市游戏,对比显示 4.7 在复杂 3D 建模、游戏机制、碰撞物理、运动学和光照方面明显更强,该对比被大量转发并被称为「最欢乐的 benchmark」。
尚未确认
- 城市游戏对比视频中的版本号「4.7」未被官方证实。
- 独立开发者 Daniel Farina 称正用 Grok 4.7 重建其 Grok 驱动浏览器 Xplor,实现了 4.6 做不到的多个功能,可跟上复杂请求;但他同时指出 3D 任务表现不佳、需极限提示词,此信息未经证实。
为什么重要
- 首日密集的正面开发者口碑为 xAI 官方「同价同速下显著提升」的宣传提供了第三方印证;长时程自主工作与超大上下文的表现若持续成立,将直接影响开发者主力模型的选择。
2026-09-22 ~ 2026-09-22 · 8 条相关
- 第 1 集:Grok 4.7 短暂现身 OpenCode Zen,疑似今日发布(2026-09-21,5 条)
- 第 2 集:xAI 发布 Grok 4.7:同价同速、基准大幅提升(2026-09-21,53 条)
- 第 3 集:Grok 4.7 被指逼近顶级前沿模型,性价比成焦点(2026-09-22,2 条)
- 第 4 集:Grok 4.7 上市即有开源编辑器插件,装机超 14 万(2026-09-22,3 条)
- 第 5 集:Grok 4.7 发布首日:开发者实测口碑与极限用例齐飞(2026-09-22,8 条)
- 第 6 集:实测 105 个植入 bug:Grok 4.7 不敌 GPT-6,也未胜 4.6(2026-09-22,4 条)
一手来源
- 知名开发者实测 Grok 4.7:日常主力体验比 4.6 大幅进步 — elonmusk ·
- 开发者实测 Grok 4.7:连续自主工作 70 小时,50 万上下文见效 — elonmusk ·
- Grok 4.7 发布首日:十个极限用例,从抓错到 Blender 建模 — minchoi ·
- Grok 4.7 曝光:开源世界城市游戏对比显示远强于 4.6 — belce_dogru · 2026-09-22
- 【源头】知名开发者实测 Grok 4.7:日常主力体验比 4.6 大幅进步 — elonmusk · 2026-09-22
- 用「建开放世界城市游戏」实测 Grok 4.7 vs 4.6,被赞最欢乐 benchmark — NicoVerderosa · 2026-09-22
- 【源头】开发者实测 Grok 4.7:连续自主工作 70 小时,50 万上下文见效 — elonmusk · 2026-09-22
- 【源头】Grok 4.7 发布首日:十个极限用例,从抓错到 Blender 建模 — minchoi · 2026-09-22
- 开发者实测 Grok 4.7:复杂编码架构很强,3D 生成仍需极限提示 — Daniel_Farinax · 2026-09-22
- Grok 4.7 上手首日:严格遵循 system prompt,实测优于 4.5 — elonmusk · 2026-09-22
- Grok 4.7 发布首日:玩家已发现 14.6 万美元漏洞、建 Blender 场景 — FinanceYF5 · 2026-09-22