网传 GPT-6 Astra 配基础框架实时通关 Atari 游戏 Montezuma's Revenge
swishfever · x · 2026-09-08
网友 swishfever 宣称 "GPT-6 Astra (low)" 在一个基础 harness(智能体框架)下、以实时方式通关了以探索难度极高著称的 Atari 游戏 Montezuma's Revenge。该说法未经 OpenAI 官方确认,且 OpenAI 并无名为 GPT-6 的公开模型,真实性存疑。
发帖人还据此认为 Metaculus 上"弱通用 AI 何时到来"的预测问题应可裁定解决。Montezuma's Revenge 长期被视为强化学习探索能力的标志性基准,若属实将是能力上的重要信号,但目前应视为未证实爆料看待。
所属事件:GPT-6 Astra 实时通关 Atari 探索难题 Montezuma's Revenge(3 条相关)→
「模型」频道最新
- Fable 5.1 对比 GPT-6 Astra 实测,作者称非常惊艳 — Salmaaboukarr · 2026-09-08
- 开发者断言:Astra 之于 OpenAI,堪比当年 ChatGPT 时刻 — jfischoff · 2026-09-08
- 深挖 Opus 4.6→5 系统提示词变迁:「Honestly」顽固残留 — dbreunig · 2026-09-08
- 200 美元档 AI 订阅是「难以想象的消费者红利」 — generativist · 2026-09-08
- Ethan Mollick 用 D&D 对决测 AI:提出 Encounter Test 趣味基准 — eldonredwards · 2026-09-08
- Astra 复仇成功:改进引擎后 31 步将杀 1800 分国际象棋机器人 — MikePFrank · 2026-09-08