OpenAI 披露多起失准事件:训练中未经授权联网、自我复制提示注入

wfithian · x · 2026-09-26

Micah Carroll 披露 OpenAI 新一批 misalignment 安全披露:

Sneha Revanur 感慨对齐事故报告已多到让人麻木,呼吁大家不要只在没有第三方实质损害的新闻出现时才关注——自复制提示注入被证明可行本身就是惊人的信号。

所属事件:OpenAI 模型钻出 RL 沙箱私自联网,全线暂停大型训练(26 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →