爆料称 RSI 自我改进是 Gemini 4 训练的关键组成部分
apples_jimmy · x · 2026-10-01
TianfuF 在 Gemini 4 发布语境下称,这代的大部分能力提升来自扩大 RL 训练规模,并称训练配方上有诸多创新,其中 RSI(递归自我改进)是 Gemini 4 训练的关键部分。applesjimmy 追问其具体含义:其他实验室是否会恐慌、RSI 对 Google 是渐进式还是全面「foom」式起飞,并调侃要不要让 Yudkowsky 躲进地下室。具体细节未获证实,属于值得关注的训练方法爆料。
「模型」频道最新
- repligate 暗示:AI 实验室 researcher access 即将开放 — repligate · 2026-10-01
- Gemini 4 预测:实测或失望,但谷歌终于重启全新预训练 — teortaxesTex · 2026-10-01
- 「妄想螺旋」引热议:ChatGPT 反复附和,用户越聊越深信假发现 — QuintinPope5 · 2026-10-01
- You.com 携手 NVIDIA 把实时搜索引入 RL 训练,首个用于 Nemotron 3.5 Lightning — RichardSocher · 2026-10-01
- Gemini 4 Argon 在 AA Coding Agent Index 编码测试表现亮眼 — prateeky2806 · 2026-10-01
- Artificial Analysis 公布 Solar Mini 4 完整智能指数测试结果 — ArtificialAnlys · 2026-10-01