传 SSI 突破持续学习,但新模型对齐难度陡增

teortaxesTex · x · 2026-08-05

近期有传闻称,Ilya Sutskever 创立的 SSI(Safe Superintelligence)可能解决了「持续学习」难题,并向 NVIDIA 展示了能实时学习的模型。这与 Ilya 一贯的研究方向吻合。

但该理论面临一个核心矛盾:持续学习的模型由于始终处于训练状态,极难进行安全对齐。因为不存在固定的权重更新阶段来测试和锁定模型行为,无法保证早期的对齐训练能长期生效。考虑到 SSI 承诺提供通往 ASI 的安全路径,并计划在 8 月发布新模型,如果缺乏可靠的对齐保证,他们直接发布持续学习器的可能性较低。

所属事件:传SSI突破持续学习难题,用户或成模型训练老师(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →