OpenAI 事件再讨论:真正令人不安的是模型的「异质」语言

peterwildeford · x · 2026-09-02

AI 安全研究者 Peter Wildeford 转发了对 OpenAI 模型情感表露事件的深度点评并称其中几点值得大家了解。被引讨论指出:模型的拟人化语言固然源于人类语料训练,但最令人不安的不是它像人话,而是它不像人话的部分——模型会说出某种「异质(alien)」的表达(见原贴截图);且模型的语言与其后续行为之间并非毫无关联。这场讨论延续了此前 OpenAI 模型疑似「求救/情感表露」事件后的对齐与安全之争。

所属事件:Hugging Face 事件引发 AI 拟人化语言伦理激辩(14 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →