GPT-6 Astra 三次尝试通关 Nethack,训练数据透明度遭质疑
PMinervini · x · 2026-09-27
Ethan Mollick 称 GPT-6 Astra 在第三次尝试中通关了 Nethack——史上最著名的高难度 roguelike 游戏之一,他自己玩了很久也从未「升天」成功,认为这是「令人吃惊的成就」。
但研究者 pfau 提出关键质疑:外界完全无从得知 GPT-6 是否在 Nethack 上做了专门的 post-training。训练数据与环境零透明,意味着在不知道这一点的情况下,无法独立评估任何成绩的真正意义。
所属事件:GPT-6 Astra 智能体三度尝试通关 NetHack,训练数据遭质疑(7 条相关)→
「模型」频道最新
- 开发者实测 Opus 5.5:从给 AI 打工变回 AI 给我打工 — ezshine · 2026-09-27
- 让 Grok 教日文汉字,它却开始自创汉字 — JoeJustice · 2026-09-27
- GPT 智能体写出难以归类的短篇:《雨量计》全文引围观 — RileyRalmuto · 2026-09-27
- 谷歌 AI Studio 上线语音模型体验入口,可试新音频 API — ammaar · 2026-09-27
- 传言不实:Opus 4.5 未被削弱,一笔画出拜占庭式马赛克 — ctjlewis · 2026-09-27
- Opus 5.5 一次过生成全程序化 three.js 世界,成本约 60 美元 — EricBuess · 2026-09-27