零数据保留下的安全检测:如何审计不可见内容?

Crescitaly · reddit · 2026-08-21

OpenAI 推出了 Private Safety Processing 预览版,旨在不保留数据的情况下跨交互检测安全模式,且不让人工接触底层内容。这种架构引发了关于可审计性的问题:客户无法直接读取内容,如何知道触发了什么策略、评估窗口是多久以及如何申诉误报?文章探讨了通过公开信号模式、可复现的客户端警报或加密证明来建立信任的可能方案。

所属事件:OpenAI 推出私有安全处理,延续零数据保留(12 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →