爆料:OpenAI 完成 GPT Bel 预训练,或采用快慢双速持续学习

imjustnewatai · x · 2026-08-26

博主爆料 OpenAI 已完成下一代预训练模型“Bel”,参数量超 10T,可能作为 GPT-6 甚至 AGI 阈值模型的基座。博主推测 Bel 将永远不会“完成”训练,而是采用双速学习机制:快速层吸收验证过的证明、代码和工具痕迹;慢速循环将通过评估的改进固化为持久权重。这一推测基于伯克利等机构 5 月发表的《Learning, Fast and Slow》论文,该论文展示了将上下文作为快速权重、参数作为慢速权重的有效性,能以更少的 rollouts 达到相同奖励且减少灾难性遗忘。

所属事件:传OpenAI完成10T参数模型Bel预训练(9 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →