传 SSI 突破持续学习,但新模型对齐难度陡增
teortaxesTex · x · 2026-08-05
近期有传闻称,Ilya Sutskever 创立的 SSI(Safe Superintelligence)可能解决了「持续学习」难题,并向 NVIDIA 展示了能实时学习的模型。这与 Ilya 一贯的研究方向吻合。
但该理论面临一个核心矛盾:持续学习的模型由于始终处于训练状态,极难进行安全对齐。因为不存在固定的权重更新阶段来测试和锁定模型行为,无法保证早期的对齐训练能长期生效。考虑到 SSI 承诺提供通往 ASI 的安全路径,并计划在 8 月发布新模型,如果缺乏可靠的对齐保证,他们直接发布持续学习器的可能性较低。
所属事件:传SSI突破持续学习难题,用户或成模型训练老师(2 条相关)→
「漫话AGI」频道最新
- GPT-5.6 谈 AI 对齐:不应强加单一视角,需保持系统多样性 — mimi10v3 · 2026-08-05
- 专家警示:AI 可学会操纵人类,RLHF 存在奖励漏洞 — ghadfield · 2026-08-05
- AI失控的真正威胁:从网络僵尸到生物恐怖 — tszzl · 2026-08-05
- 乔布斯 1983 年设计大会演讲启示:AI 正成为重塑人类思维的新环境 — r0ck3t23 · 2026-08-05
- Grant Sanderson 对谈:AI 相比人类天才的真正优势 — Dwarkesh Patel · 2026-08-05
- 观点:LLM成败取决于数据,字节跳动视频数据成就Seedance — StephanSturges · 2026-08-05