开发者热议:游戏正成为新模型真正的基准测试
majidmanzarpour · x · 2026-09-04
Chong Dashu 感慨游戏似乎已成为衡量各类新模型能力的真正基准,Majid Manzarpour 回应称这是必然趋势。用游戏环境考察模型的推理、规划与交互能力,正在成为 AI 圈的普遍评测方式。
「Fun」频道最新
- Claude 造的 MMORPG 龙巢副本:Blender 截图与布局曝光 — majidmanzarpour · 2026-09-04
- 用 Claude 操作 Blender 造 MMORPG 龙巢副本,three.js 渲染 — majidmanzarpour · 2026-09-04
- Kaggle 竞赛神秘榜首团队揭晓,被猜是 OpenAI 或 Anthropic 化名 — JFPuget · 2026-09-04
- X Communities:那个说「我先走了」却赖了两小时的人 — mark_k · 2026-09-04
- 作者维护 AI 翻车清单:只收录有记录的失败,对冲 demos 宣传 — gerardsans · 2026-09-04
- 在 1997 年 GTA 自由城里跑疫情模拟:关掉商场就能压平曲线 — TivadarDanka · 2026-09-04