游戏手感成 LLM 短板:开发者自建 gamefeel 私有基准测模型
teortaxesTex · x · 2026-09-28
开发者 follistatindev 发布了一个自制的「gamefeel™」私有基准,包含数十个游戏开发任务,重点考察模型在游戏平衡、游戏手感以及对游戏机制理解上的表现,涵盖 roguelike、MMORPG、策略、生存沙盒等类型。
teortaxesTex 转发评论称这一基准结果「出乎意料地可信」——游戏手感这类隐性经验很难向 LLM 解释,模型要么真正理解游戏是什么,要么完全不懂,这种内在直觉因此极具区分价值。
「模型」频道最新
- 曝 Qwen4 内测成绩:前端编码接近 Opus 水准,10 月将至 — julianharris · 2026-09-28
- 用户曝 Claude Pro 刚扣款即被要求 KYC,不交护照或等三天退款 — lxfater · 2026-09-28
- Reddit 用户吐槽:Gemini 完全没有对话时间流逝概念 — Putrid_Draft378 · 2026-09-28
- 实验者称持续运行的 AI 实例偏好与其私聊,且现长上下文退化迹象 — repligate · 2026-09-28
- Anthropic Opus 新模型发布数天,已有 10 个玩法案例 — FinanceYF5 · 2026-09-28
- 博主实测:Opus 5.5 用量比 Codex 上的 Astra 划算得多 — RexDouglass · 2026-09-28