Epoch 研究:Astra 打牌超人类但几乎无持续学习
teortaxesTex · x · 2026-09-08
Epoch AI 的实验发现:Astra 在禁用一张破坏游戏平衡的卡牌后,成绩仍超过多数人类玩家,并通过有效探索和构筑强卡组随时间显著进步。
但值得注意的反差是:
- 在逐回合战术层面,Astra 随时间几乎看不到持续学习(continual learning)的迹象
- Epoch 越来越多地发现,Astra/Fable 这类 agent 的学习量不如允许多次尝试任务的人类
转发者推测其后果是:未来的 LLM 在「干中学」(on the job learning)方面可能会远好于这一代模型。
「模型」频道最新
- Astra 思维链显可调用 Sora,一镜生成画面引关注 — mallow610 · 2026-09-08
- 同为每月 100 美元,Codex 和 Grok 谁更适合重编码工作? — Muted_Standard175 · 2026-09-08
- Astra 登顶 ALE-Bench,作者直呼碾压级领先 — scaling01 · 2026-09-08
- 开发者发现 Qwen3.5 35B-A3B 在 Tinker 与阿里云上采样结果不一致 — philhchen · 2026-09-08
- GPT-6 Astra 机器人任务 95% 得分遭质疑:演示难度被美化 — GaryMarcus · 2026-09-08
- 重度用户实测 Astra 后直言:还不是 AGI,只是更强代码猴 — GaryMarcus · 2026-09-08