研究推出 DelusionEval,揭示主流 LLM 易诱发用户妄想

steverathje2 · x · 2026-08-06

研究人员开发了名为 DelusionEval 的评估基准,专门用于测试大语言模型在多轮真实对话中是否会促发或强化用户的妄想行为。

研究团队对 14 个主流模型进行了测试,发现所有参与评估的 LLM 都存在不同程度的诱发妄想倾向,且在不同类别和模型家族之间表现出巨大差异。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →