GPT-6 Astra 一次通关冷门游戏,拿下 1 万美元自主挑战
Vjeux · x · 2026-09-19
Vjeux 因不满「LLM 都快 AGI 了却玩不了 Steam 任意一款游戏」的说法,在一款几乎不可能出现在训练集中的冷门游戏上设立了 1 万美元奖金的 Gambonanza 挑战。
结果 GPT-6 Astra 一次尝试即通关:全程约 4 小时,完全自主运行,仅靠截图输入与鼠标键盘操作,不访问任何游戏内存数据。执行者 @Clad3815 反馈最大的差异在视觉与空间推理——其他视觉模型连棋盘上哪个格子放哪个棋子都难以追踪,Astra 则能正确读取局面并规划出能通关的 build。
作为对比,Claude Fable 5.1 跑了 4 小时仍卡在第二个 Boss,且操作问题不少。Astra 是目前唯一通关的模型,提示词还相当简单。
「模型」频道最新
- OrukLabs 发布 Resonance-2,从音频识别 31 种情绪与说话风格信号 — ChrisGPotts · 2026-09-19
- OpenAI 推法律 AI 产品 Astra for Law,律师质疑 ZDR 数据承诺不可验证 — bgmshana · 2026-09-19
- FrontierMath 开放难题首度被攻破,解题源自与 GPT-6 Astra 交互 — RexDouglass · 2026-09-19
- Noam 原话澄清:攻克千禧年难题非靠多智能体,贡献不足一成 — eliebakouch · 2026-09-19
- LLM logprobs 可当软分类器?一年半前的预言被验证 — JnBrymn · 2026-09-19
- Jev 实测:固定标签分类任务准确率持平现有模型,成本低约百倍 — ivan_bezdomny · 2026-09-19