斯坦福论文:API 审计结论无法代表聊天机器人真实体验

斯坦福 AI 实验室转发的 EMNLP 新论文(Jenn Wang 主导)指出,第三方审计者通常通过 API 对模型进行安全等审计,但这些结论并不能迁移到面向用户的聊天机器人界面。作者对 ChatGPT 等七款 AI 系统进行对比研究,发现 API 审计结果与终端用户实际获得的内容存在差异,提示审计方法需更贴近真实使用场景。

2026-09-16 ~ 2026-09-16 · 2 条相关