推理与 RL 训练的 scaling 优于预训练

tobyordoxford · x · 2026-07-03

Toby Ord 指出,按 AI scaling law 常规标准衡量,当前的 scaling 表现相当不错:预训练要把误差减半需要约 100 万倍算力;而在数学 benchmark 上,推理 scaling 和 RL 训练都能带来对数级提升。是同一 AISecurityInst 议题中信息量最高的一条。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →