GPT-6 Astra 刷爆 ARC-AGI-3,操作步数还少于人类平均水平
TimeTruth2490 · reddit · 2026-09-04
据 ARC Prize 官方博客,GPT-6 Astra 不仅在 ARC-AGI-3 上达到饱和(saturate),而且完成任务所用的操作步数比人类平均水平还少。这一结果意味着 ARC-AGI-3 作为通用推理基准的区分度可能已被前沿模型突破。
所属事件:GPT-6 Astra 刷爆 ARC-AGI-3,步数少于人类(5 条相关)→
「模型」频道最新
- Sam Altman 暗示 Astra 完整访问或本周末开放,本月或迎 3 次额度重置 — iruletheworldmo · 2026-09-04
- 分析师:至今没有非 NVIDIA 训练的模型能击败 NVIDIA 训练的模型 — BenBajarin · 2026-09-04
- 12 名 PhD 团队 Mostik 用潜空间通信登顶 ARC-AGI 榜 — VoidAsuka · 2026-09-04
- 开发者晒参与 OpenAI Astra 项目成果,称期待生态应用 — oyhsu · 2026-09-04
- Fable 5.1 给 agent 命名延续 Fable 5 风格,模型人格稳定性受关注 — repligate · 2026-09-04
- OpenAI 随 GPT-6 Astra 发布承诺 10 亿美元补贴网络安全防御 — EricBuess · 2026-09-04