AI 智能体「玩 Doom」被拆穿:输入全游戏状态文本,30 行代码就能实现
banteg · x · 2026-09-16
一场号称「AI 实时玩 Doom」的演示遭到技术拆解:所谓智能体 Jev 的输入并非画面,而是包含完整游戏状态(怪物、物品、位置)的文本转储,且经过大量预处理(位置均相对玩家、附带可见性等信息),决策被大幅简化。批评者指出,在这种全状态输入下躲避弹幕和空房间射击是平凡问题,硬编码 30-40 行代码即可实现;展示的导航探索部分也看不到真正的规划与寻路能力。官方宣传的「10 次调用/秒 ≈ $7/小时」成本,反而被指是精心包装的专家级营销,观众误以为它能开箱即玩真正的图像版 Doom。
「Fun」频道最新
- 用 Margolus 邻域做细胞自动机:沙落水流的可交互世界 — mhmazur · 2026-09-16
- 前 OpenAI 工程师痛斥 EA 圈:用理性包装毒性,劝人远离 — suchenzang · 2026-09-16
- 2026 年逆向工程日常:一句目标交给 agent,遛狗回来 IDA 全部搞定 — dyn___ · 2026-09-16
- Chenglou 调侃:Typesafe AI 一旦加上图像输入,机器人要变搞笑了 — FrankFelixAI · 2026-09-16
- 网友晒图感慨:从没意识到 Dario Amodei 的真实身高 — djcows · 2026-09-16
- 教授把与朋友两年的 AI 伴侣争论喂给 AI,让它写成对话体长文 — minzlicht · 2026-09-16