Ramez 谈 AI 安全:对齐派与工程派都错了,该做纵深防御
sebkrier · x · 2026-10-12
Ramez Kazemi 表示在 AI 安全辩论中不同意两个极端阵营:一是「只有对齐论」,认为超级智能终将攻破一切沙箱与防护;二是「只有工程论」,认为对齐是伪命题、只需更好的安全系统。他主张两条线同时推进,像洋葱一样构建多层独立且正交的安全防护,同时降低事故与恶意使用的风险。他澄清自己指的是「正向对齐」——良好的指令遵循、避免危险的自作主张、诚实、可监控与透明,而非拒绝用户请求的负向对齐。
「漫话AGI」频道最新
- AIES 论文:AI 或助西方民主政体滑向威权式治理实践 — DavidSKrueger · 2026-10-12
- Ethan Mollick:最强模型同样最有创造力、洞察力与美感 — emollick · 2026-10-12
- 数学家叹 AI「团灭」我的研究领域,学生已用 AI 当私教 — LukeW · 2026-10-12
- Pedro Domingos 嘲讽 AGI 派:递归自改进失败后将无牌可打 — pmddomingos · 2026-10-12
- 观点:AI 让日常工程中的数学应用变易,将是最大技术成就之一 — _onionesque · 2026-10-12
- 隐性知识之争:百万 AI 抽象思考难以替代一线实战经验 — binarybits · 2026-10-12