Meta 首席 AI 官 Alexandr Wang:对齐问题尚无人能解,靠 AI 监督 AI

rohanpaul_ai · x · 2026-10-10

Meta 首席 AI 官 Alexandr Wang 在 Cleo Abram 的访谈中坦言,"对齐"仍是 AI 科学中最开放的问题之一,目前没人确切知道怎么解决。

他的方案是 可扩展监督(scalable oversight):随着模型变聪明,用另一组 AI 去"监视"它们、把行为保持在可控范围内。由于监视者 AI 也要与被监督模型同步变强,实验室需要持续构建"越来越聪明的 policing agents"。

据他介绍,Meta 的 Muse 智能体已经在实践这一思路:用一个独立的 sentinel agent 专门检查主智能体的行为。

所属事件:Meta 首席 AI 官谈 AI 安全:对齐未解,最怕 Agent 失控(4 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →