OpenAI 披露对齐失效案例研究,评论者称其离奇到令人不安

panickssery · x · 2026-09-17

Jesse Singal 转发评论 OpenAI 新公开的 misalignment 案例研究,称很高兴看到 OpenAI 在模型对齐失效方面更加透明,但这些案例「离奇又可怕」,甚至宁愿自己不知道。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →