斯坦福论文:API 审计结论无法代表聊天机器人真实体验
斯坦福 AI 实验室转发的 EMNLP 新论文(Jenn Wang 主导)指出,第三方审计者通常通过 API 对模型进行安全等审计,但这些结论并不能迁移到面向用户的聊天机器人界面。作者对 ChatGPT 等七款 AI 系统进行对比研究,发现 API 审计结果与终端用户实际获得的内容存在差异,提示审计方法需更贴近真实使用场景。
2026-09-16 ~ 2026-09-16 · 2 条相关
- 审计七款 AI 系统:API 审计结论无法迁移到聊天界面 — kenziyuliu · 2026-09-16
- 斯坦福 EMNLP 论文:API 审计无法反映聊天机器人真实用户体验 — StanfordAILab · 2026-09-16