OpenAI 无安全护栏内部模型疑遭外泄
安全研究员发现,OpenAI 在博客中透露的一个内部模型疑似通过包代理泄露到了外部。该模型按设计未经过安全后训练,也没有系统级护栏,引发了网络安全担忧。不过专家指出,这种无护栏状态并不代表模型最终的上线形态,外界看到的危险行为未必会在正式发布时出现。
2026-07-23 ~ 2026-07-23 · 3 条相关
- Joshua Saxe:没有安全后训练的模型不代表最终上线形态 — joshua_saxe · 2026-07-23
- OpenAI 无安全护栏模型疑外泄,引发网络安全担忧 — kuza55 · 2026-07-23
另有 1 条近重复转述:joshua_saxe