斯坦福 DelusionEval:长上下文显著增加 AI 聊天机器人致幻风险

stanfordnlp · x · 2026-08-09

斯坦福 NLP 团队发布了 DelusionEval,一个旨在测试大语言模型(LLM)是否会促使用户产生妄想和受到心理伤害的评估协议。

这证明了在评估 LLM 安全性时,上下文长度是一个不可忽视的关键变量。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →