爆料:OpenAI 完成 GPT Bel 预训练,或采用快慢双速持续学习
imjustnewatai · x · 2026-08-26
博主爆料 OpenAI 已完成下一代预训练模型“Bel”,参数量超 10T,可能作为 GPT-6 甚至 AGI 阈值模型的基座。博主推测 Bel 将永远不会“完成”训练,而是采用双速学习机制:快速层吸收验证过的证明、代码和工具痕迹;慢速循环将通过评估的改进固化为持久权重。这一推测基于伯克利等机构 5 月发表的《Learning, Fast and Slow》论文,该论文展示了将上下文作为快速权重、参数作为慢速权重的有效性,能以更少的 rollouts 达到相同奖励且减少灾难性遗忘。
所属事件:传OpenAI完成10T参数模型Bel预训练(9 条相关)→
「模型」频道最新
- AI 模型在智力测试中频频翻车,人类仍占上风 — nordicinst · 2026-08-26
- AI 仍过不了这些智力测验:空间旋转与视觉推理是明显短板 — MIT Tech Review AI · 2026-08-26
- 数据称开发者对模型零忠诚:Ox Alpha 三天碾压 DeepSeek V4 Flash — FinanceYF5 · 2026-08-26
- OX Alpha 凭借免费策略登顶 OpenRouter 使用量榜首 — Hesamation · 2026-08-26
- 27B 模型击败前沿模型?Qwen 3.8 实测惊人 — Gohab2001 · 2026-08-26
- 后训练把模型带入了新的恐怖谷 — jongranskog · 2026-08-26