用「建开放世界城市游戏」实测 Grok 4.7 vs 4.6,被赞最欢乐 benchmark
NicoVerderosa · x · 2026-09-22
有网友发布了一组对比视频:让 Grok 4.7 和 Grok 4.6 各自构建一个开放世界城市游戏,直观展示两代模型在生成复杂交互场景上的能力差异。
这条对比被大量转发围观,转发者直呼「这是我见过最好的 benchmark」——用实际游戏构建任务来测编码与空间生成能力,比跑分榜单更直观好笑。具体差距见原视频。
所属事件:用户实测 Grok 4.7 对比 4.6,构建城市游戏显代际提升(2 条相关)→
「Fun」频道最新
- 开发者 Jason Kneen 遭 npm org 强行接管,对方商标主张前后矛盾 — jasonkneen · 2026-09-22
- satire:谷歌称 AI 跑到新泽西喝酒赌博去了 — NeoYossarian · 2026-09-22
- 电梯里被同事问亏四次曲线的三切平面数,答案是 120 — littmath · 2026-09-22
- Pedro Domingos 讽 AGI 论:「照人类做就能 AGI?」 — pmddomingos · 2026-09-22
- Gautam Kamath 谈 AI 使用争议:有人被指双标后索性挂出私信 — thegautamkamath · 2026-09-22
- Ezra Klein 全面接受 AI 存险论,怀疑派反思说服失败 — ProfAndyCarp · 2026-09-22