分析:模型玩宝可梦对战差点翻车,给出的理由还是错的
BlancheMinerva · x · 2026-09-30
- 研究者 BlancheMinerva 分析某模型打宝可梦对战的录像:模型险些输掉——如果对 Arcanine 一战运气稍差且它不改变决策就可能失败,且似乎还有数条「复活」机会没用完;对 Aerodactyl 一战也几乎输掉整场。
- 她推测模型是否知道对方队伍配置:若知道,用 Alakazam 对阵 Agatha 是好选择,但模型给出的理由是错的,实际上在事实层面站不住脚——决策对了、解释错了。
所属事件:研究者复盘 AI 玩宝可梦:险胜且决策与理由存疑(3 条相关)→
「模型」频道最新
- 离开AI一周错过的猛料:6.1 Sol发布、澳洲健康险商被ChatGPT黑客攻破 — flowersslop · 2026-09-30
- 用户莫名其妙收到 OpenAI 赠送的 62,496 个免费额度 — imjustnewatai · 2026-09-30
- 用户让 Claude 打破一切英语规范,效果惊艳 — repligate · 2026-09-30
- DeepSeek 双人设之争:男版形象为何火不过「大肥鱼」 — teortaxesTex · 2026-09-30
- Reddit 用户怒批 Gemini:幻觉频出、编造菜单项,称其应下线 — 782468 · 2026-09-30
- 用户实测 GPT-6.1 Sol 疑似遭悄悄降级,输出乱成 3B 模型 — Ferzelibey · 2026-09-30