研究者 argue 对齐非万能:更该加固的是非 AI 系统本身

gandamu_ml · x · 2026-09-25

用户 gandamuml 在回复 Schmidhuber 相关讨论时提出观点:不要把「对齐」当作万能解药。即使能训练出对齐的模型,训练任意模型的门槛也在持续降低,任何人都可以训练不对齐的模型。因此他认为更务实的路径是让一切非 AI 系统(社会、基础设施、防御机制)随之变得更健壮,而只盯着 AI 本身做对齐「像是一种魔法思维」。这是 AI 安全社区中「对齐 vs 鲁棒性」之争的一个代表性论点。

所属事件:Schmidhuber 争论后续:对齐非万能,系统需更鲁棒(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →