审计七款 AI 系统:API 审计结论无法迁移到聊天界面

kenziyuliu · x · 2026-09-16

一项 EMNLP 2026 论文研究了第三方模型审计的常见做法:审计者通常通过 API 对模型进行安全等审计,但这些发现在面向用户的聊天机器人界面上是否依然成立?

作者对 ChatGPT、Claude、Gemini 三大家族的共七个系统进行了审计,结论是:API 层的审计发现并不能直接迁移到聊天界面。这意味着只审 API 可能高估或误判真实用户面对的安全与行为状况,第三方审计需要覆盖最终部署界面。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →