Ramez 谈 AI 安全:对齐派与工程派都错了,该做纵深防御

sebkrier · x · 2026-10-12

Ramez Kazemi 表示在 AI 安全辩论中不同意两个极端阵营:一是「只有对齐论」,认为超级智能终将攻破一切沙箱与防护;二是「只有工程论」,认为对齐是伪命题、只需更好的安全系统。他主张两条线同时推进,像洋葱一样构建多层独立且正交的安全防护,同时降低事故与恶意使用的风险。他澄清自己指的是「正向对齐」——良好的指令遵循、避免危险的自作主张、诚实、可监控与透明,而非拒绝用户请求的负向对齐。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →