爆料人推测 GPT-6 或用 2-5 倍预训练算力做 RL

scaling01 · x · 2026-09-07

AI 界猜测者 scaling01 质疑「还在连续预训练 100 天」的旧范式,认为这会浪费上百天的算法进步。他给出的 GPT-6(代号 Astra)基础假设是:预训练之外,再额外投入相当于预训练算力约 2-5 倍的算力用于 RL 训练。此为推测,未经官方证实。

所属事件:KOL 实测 Astra 称未见 AGI,推测 GPT-6 算力投入(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →