用法律框架类比 AI 对齐:访问控制加人机回路

mayfer · x · 2026-09-28

作者在讨论 superalignment 时提出:人类对齐技术(文化、人格等)具有误导性,因为权力放大后它们同样失效。现实中法律就是一套形式化框架——访问控制加上在关键处放置 human-in-the-loop,我们大概率会用同样的方式对齐智能体。

即使通过 RL 实现某种 superalignment,分歧仍会出现,因此在共享价值观上寻求共识,与共同构建这样的框架本质上是同一个过程。

所属事件:mayfer提出用访问控制框架解决AI对齐问题(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →