斯坦福 EMNLP 论文:API 审计无法反映聊天机器人真实用户体验

StanfordAILab · x · 2026-09-16

斯坦福 AI 实验室转发其 EMNLP 新论文(由 Jenn Wang 主导),核心观点是:通过 API 对模型做审计,并不能代表终端用户在聊天机器人里实际得到的内容。

作者以此论证第三方访问(API access)之争的焦点应该是「系统」而不仅是「模型」——同一模型在不同系统封装下行为可能大不相同,监管与审计若只盯模型层会漏掉真实风险。

所属事件:斯坦福论文:API 审计结论无法代表聊天机器人真实体验(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →