研究测 13 款主流 LLM:10%-35% 陈述因说话者性别被改判真假

anthara_ai · x · 2026-09-03

一项针对 13 款主流大模型的实验发现,所有模型都表现出对男性的显著负面情绪倾向。

实验方法:仅改变陈述说话者的性别呈现(中性/男/女),观察 AI 对真假判断是否改变。

关键发现:

结论:自动化系统中的隐性别偏见可能直接影响事实判断的一致性,对依赖 LLM 做审核/评估的场景是潜在风险。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →