学者批 OpenAI 对齐定义过窄:仅遵指令不足以对齐人类

davidmanheim · x · 2026-08-09

有学者指出,OpenAI 对“对齐”的定义似乎过于狭隘,仅要求模型“遵循规范或服从指令”。

评论认为,如果 AI 只是盲目服从小部分人写出的指令,默认情况下就会与全人类的整体利益相违背。此外,任何规范都无法覆盖所有的分布外(OOD)情况,这并不符合应用伦理学的运作方式。安全社区需要重新审视这种问题定义的错位。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →