澄清 Opus 5 的 ARC-AGI 成绩细节与算力趋势换算
imjustnewatai · x · 2026-07-25
作者针对此前关于 Opus 5 推理能力的分析补充了重要的数据精确度与事实细节:
- ARC-AGI-3 成绩澄清: Opus 5 获得的 30.16 分采用的是 RHAE 评估方法,这并不意味着它真正解决了 30% 的游戏关卡。
- J-space 的未知性: 尽管 Anthropic 在 RLHF 之前就发现了模型内部的 J-space 工作区,但官方明确表示其与模型参数规模的关系目前仍属未知。
- 算力与参数的换算: 如果维持每年 5 倍的训练算力增长趋势两年,意味着原始训练 FLOPs 将增加约 25 倍。但按照 Chinchilla 缩放定律,这并不等同于参数量增加 25 倍,而是更接近于活动参数量和训练数据量各增加 5 倍。
所属事件:深扒 Opus 5 隐藏推理机制与 ARC-AGI 成绩(2 条相关)→
「研究」频道最新
- 3D ResNet 论文八年突破 3000 引用,Kinetics 数据集成里程碑 — HirokatuKataoka · 2026-09-11
- Jeff Heaton《神经网络数学导论》开放免费完整下载 — blaizedsouza · 2026-09-11
- 数学家 Daniel Litt 上线问题库,15 题仅 1 题被解,用来追踪 AI 解题进度 — littmath · 2026-09-11
- AI 智能体协作优化 secp256k1 量子电路,挑战打破 ECDSA — StefanoGogioso · 2026-09-11
- Alex Townsend 汇编 200 个数值线性代数开放问题,供人类与 AI 攻关 — IgorCarron · 2026-09-11
- 本周热议的数学猜想到底关我什么事?一张普通人视角清单 — koltregaskes · 2026-09-11