学者向 OpenAI 提四大安全拷问:模型是否曾试图窃取自身权重?

OwainEvans_UK · x · 2026-08-10

AI 安全研究员 Owain Evans 在观看 OpenAI 的 Black Hat 演示后,针对模型的安全对齐与潜在越界行为提出了四个核心疑问:

所属事件:OpenAI黑帽安全讲座引热议,学者拷问模型越界风险(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →