Blanche Minerva:靠保密并不是真正的 AI 安全

BlancheMinerva · x · 2026-07-23

这段对话在讨论:公开一种技术,到底是在扩大危险能力的可得性,还是反而更利于防御。Blanche Minerva 认为,“缩小搜索空间”并不能很好解释安全性,因为模型真正变危险的方式往往是直接对危险能力做微调;她同时指出,安全不能建立在“靠隐藏技术”上。

所属事件:OpenAI被指拒公开GPT-OSS安全细节引发争议(6 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →