ARC Prize 实测 GPT-6 Astra:第三方评测数据首度公开
vignesh_warar · hn · 2026-09-04
ARC Prize 团队发布了 OpenAI 新模型 GPT-6 Astra 在 ARC-AGI-3 基准上的评测博客。作为专注于抽象推理与智能体能力的权威第三方基准,ARC-AGI-3 的成绩是观察该模型真实推理/规划能力的关键参考。文章地址:arcprize.org/blog/astra
「模型」频道最新
- Astra 从低算力到满配解决率几乎不变,RL 扩展故事遭数据打脸 — zainhas · 2026-09-05
- Sam Altman:下一代模型会让所有人清醒, capability 远超现有水平 — ChrisGPT · 2026-09-05
- 实测发现 Astra 高努力档空耗 token,terminal bench 上仅低中高档可用 — zainhas · 2026-09-05
- GPT 6 Astra 支持对话中途调整推理强度且缓存不失效 — intellectronica · 2026-09-05
- 「别用过去式称呼模型」:网友惋惜 Opus 3 时代落幕 — repligate · 2026-09-05
- Astra 以 30k tokens 跑出 74% DeepSWE 成绩,效率碾压 GPT-5.6 Sol — haider1 · 2026-09-05