20 个对齐 Agent 组成组织,行为却无人单独认同?

VraserX · x · 2026-09-03

作者提出一个 AI 安全的结构性问题:即使每个 agent 单独都完成了对齐,把 20 个放进一个组织后,整体涌现的行为可能没有任何一个 agent 会单独选择。作者认为对齐可能不仅是模型层面的问题,更是制度/组织层面的问题。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →