Astra 刷满 ARC-AGI-3 基准,用步数比人类平均更少
ObiWanCanownme · reddit · 2026-09-04
ARC Prize 官方博客披露,智能体 Astra 在新一代交互式推理基准 ARC-AGI-3 上实现了饱和(拿到该基准的最高可达分数),而且完成任务所用的操作步数比人类玩家的平均值还要少,是目前该基准上已知最强战绩之一。
所属事件:GPT-6 Astra 刷爆 ARC-AGI-3,隐式推理引热议(6 条相关)→
「模型」频道最新
- 用 Astra 后 ChatGPT 图像生成明显变强 — joshua_saxe · 2026-09-05
- Fable 5.1 对比 GPT 6 Astra 生成 3D Blender 资产,差距惊人 — curious_capsuleer · 2026-09-05
- 爆料称 GPT 6 Astra 一条提示词完美复刻《宝可梦》 — IanArawjo · 2026-09-05
- 用户弃 Gemini 回归 GPT:10 次生成 PDF 9 次被拒,用量消耗还更高 — DrlNoV · 2026-09-05
- GPT-6 Astra 推出实验性压缩机制:跨上下文窗口存笔记可检索 — TheMoonMidas · 2026-09-05
- 同一提示词喂给 Opus 4.8、Fable 5.1 与 GPT 6 Astra,结果对比 — LightningMcLovin · 2026-09-05