学者批 OpenAI 对齐定义过窄:仅遵指令不足以对齐人类
davidmanheim · x · 2026-08-09
有学者指出,OpenAI 对“对齐”的定义似乎过于狭隘,仅要求模型“遵循规范或服从指令”。
评论认为,如果 AI 只是盲目服从小部分人写出的指令,默认情况下就会与全人类的整体利益相违背。此外,任何规范都无法覆盖所有的分布外(OOD)情况,这并不符合应用伦理学的运作方式。安全社区需要重新审视这种问题定义的错位。
「漫话AGI」频道最新
- AI做游戏画面容易但好玩难,游戏设计仍是人类壁垒 — pvncher · 2026-08-09
- Vibe coding 加速了开发,但客户注意力并未同步增长 — Ubunta · 2026-08-09
- Cathie Wood:AI 与生产力跃升正支撑美国企业利润率创历史新高 — CathieDWood · 2026-08-09
- 独立 AI 智能体为何缺少“App Store”?分发成痛点 — mgsz_ · 2026-08-09
- Gwern长文:个性化LLM应模拟用户偏好,化身生产力守护天使 — morgymcg · 2026-08-09
- AI 距离下一个爱因斯坦有多远?论文指出其缺乏构建基础理论的能力 — pickover · 2026-08-09