AI 安全圈激辩:alignment 一词该不该进政策讨论

kdkeck · x · 2026-09-22

围绕 @davidmanheim 的观点,AI 研究者们就「alignment」术语是否适合在政策讨论中使用展开争论。kdkeck 认为,该词只在正确理解对齐概念的圈内才有实质意义,建议在政策圈改用 safety、liability、perverse incentives、moral hazard 等更熟知的术语,但不主张禁用。davidmanheim 则反驳:如果无法说明「系统安全」与「对齐」是两回事,就无法对未来的系统做出合理的政策决策——而这正是当前争论的核心。

所属事件:AI 安全圈激辩:「对齐」一词是否还能用于政策讨论(4 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →