davidmanheim:我们尚不知如何「驾驭」AI,前沿公司押注日后补救

davidmanheim · x · 2026-09-15

davidmanheim 在对齐讨论中称,「以一种能降低灾难概率的方式去驾驭一项注定会被开发出来的技术」的想法很荒谬:我们目前并不知道如何足够好地驾驭这些系统,多数前沿公司也清楚这一点——它们的赌注是我们以后会想办法修复。此前他解释,若未来强 AI 对齐差到会应要求作恶,而控制手段的理解极其有限、过度优化普遍存在,广泛采用将是灾难。

所属事件:对齐研究者激辩:AI 对齐是否取决于 system prompt(6 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →