持续学习一旦普及,本地权重副本将让安全护栏失效

AashaySachdeva · x · 2026-08-17

作者提出一个安全隐忧:如果持续学习(continual learning)被解决,且每个人都拥有自己的一份模型权重副本,那么所有内置的安全过滤器都将形同虚设。这触及了开源权重模型与对齐护栏之间长期存在的张力——当模型可以在本地任意微调时,厂商端的安全措施便无从执行。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →