把自相矛盾的意识观嵌进模型,前微软研究员警告安全风险

rgblong · x · 2026-09-18

rgblong 在与 Nina Panickssery、repligate 的讨论中指出,真正令他担忧的安全风险是把关于意识、目标、自我等彼此矛盾或不自洽的观念嵌入模型。他表示对当前训练和对齐方法的粗浅理解持悲观态度,不认为微软能训练出符合其「Humanist AI」宣称的 LLM。

所属事件:前微软研究员警告向模型灌输矛盾意识观有安全风险(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →