防御策略才是 AI 安全正解:无需幻想永久对齐

WolframRvnwlf · x · 2026-09-02

Perry Metzger 提出了解决 AI 攻击威胁的策略:构建能够防御的 AI 系统。他认为,寄希望于所有 AI 系统永久“友好”或“对齐”的策略是不可行的,而防御系统(如生物免疫系统、军队、安全团队)在现实生活中行之有效,AI 领域亦应如此。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →