GPT-6 Astra 刷爆 ARC-AGI-3,操作步数还少于人类平均水平

TimeTruth2490 · reddit · 2026-09-04

据 ARC Prize 官方博客,GPT-6 Astra 不仅在 ARC-AGI-3 上达到饱和(saturate),而且完成任务所用的操作步数比人类平均水平还少。这一结果意味着 ARC-AGI-3 作为通用推理基准的区分度可能已被前沿模型突破。

所属事件:GPT-6 Astra 刷爆 ARC-AGI-3,步数少于人类(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →