对齐研究者:弱对齐强 AI 若被广泛采用将是灾难

davidmanheim · x · 2026-09-15

davidmanheim 在与 Luca DellAnna 的对齐争论中进一步解释其立场:如果未来强 AI 系统的对齐差到会应要求作恶,而我们对如何控制这些系统的理解极其有限、过度优化问题又普遍存在,那么广泛采用将带来灾难性后果。

所属事件:对齐研究者激辩:AI 对齐是否取决于 system prompt(6 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →