HCOMP 论文:LLM 解释越流畅易读,仇恨言论审核越易过度依赖

windx0303 · x · 2026-09-30

Bing Tuo 团队从澳大利亚远赴华盛顿在 HCOMP 2026 展示其荣誉提名(Honorable Mention)论文《Easy to Read, Easy to Trust》。

论文研究 LLM 解释文本的处理流畅度(processing fluency)如何影响人在仇恨言论内容审核中的过度依赖(over-reliance):结论指向「写得好读的解释反而更容易让人不加审视地信任模型输出」,对审核场景中人机协作设计有直接警示意义。

所属事件:HCOMP 2026 论文:LLM 解释越流畅,审核越易过度信任(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →