用「建开放世界城市游戏」实测 Grok 4.7 vs 4.6,被赞最欢乐 benchmark

NicoVerderosa · x · 2026-09-22

有网友发布了一组对比视频:让 Grok 4.7 和 Grok 4.6 各自构建一个开放世界城市游戏,直观展示两代模型在生成复杂交互场景上的能力差异。

这条对比被大量转发围观,转发者直呼「这是我见过最好的 benchmark」——用实际游戏构建任务来测编码与空间生成能力,比跑分榜单更直观好笑。具体差距见原视频。

所属事件:用户实测 Grok 4.7 对比 4.6,构建城市游戏显代际提升(2 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →