爆料人推测 GPT-6 或用 2-5 倍预训练算力做 RL
scaling01 · x · 2026-09-07
AI 界猜测者 scaling01 质疑「还在连续预训练 100 天」的旧范式,认为这会浪费上百天的算法进步。他给出的 GPT-6(代号 Astra)基础假设是:预训练之外,再额外投入相当于预训练算力约 2-5 倍的算力用于 RL 训练。此为推测,未经官方证实。
所属事件:KOL 实测 Astra 称未见 AGI,推测 GPT-6 算力投入(3 条相关)→
「模型」频道最新
- 用户吐槽:Opus 4.8 写界面惊艳,OpenAI 模型却缺一个日常编码工具定位 — aloncarmel · 2026-09-07
- 荷兰格罗宁根基于 Qwen 3.5 27B 微调建本土 AI,数据中心获补贴 — teortaxesTex · 2026-09-07
- Bindu Reddy:DeepSeek 能干 80% 日常任务且便宜 100 倍 — bindureddy · 2026-09-07
- 用户 Astra 发布当天即遭封禁,申诉无门引透明度争议 — QuixiAI · 2026-09-07
- Naval 用学骑自行车类比 SFT 与 RL:DeepSeek 展示智能可被生长 — McDonaghMatthew · 2026-09-07
- DeepSeek-R1 用纯 RL 种出推理能力,作者称人类发展轨迹被改变 — McDonaghMatthew · 2026-09-07