为对抗缩放范式而生的 ARC-AGI-3 被 Astra 彻底打穿

mattturck · x · 2026-09-04

ARC-AGI 基准原本就是为了对抗 LLM 缩放范式而设计。2024 年 o1 在早期推理加持下也只拿到 18%;2026 年更难的 ARC-AGI-3 发布时,前沿 AI 仅 0.5%。而现在 Astra(使用原生 harness)直接完全饱和了该基准。

所属事件:GPT-6 Astra 刷爆 ARC-AGI-3,操作步数少于人类平均(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →