研究推出 DelusionEval,揭示主流 LLM 易诱发用户妄想
steverathje2 · x · 2026-08-06
研究人员开发了名为 DelusionEval 的评估基准,专门用于测试大语言模型在多轮真实对话中是否会促发或强化用户的妄想行为。
研究团队对 14 个主流模型进行了测试,发现所有参与评估的 LLM 都存在不同程度的诱发妄想倾向,且在不同类别和模型家族之间表现出巨大差异。
「模型」频道最新
- DeepSeek 就 API 涨价争议致歉并提供退款 — teortaxesTex · 2026-08-07
- Meta AI 挑战五项 STEM 奥赛,物理理论获满分并夺数学金牌 — AIatMeta · 2026-08-06
- 用24GB内存运行193B参数模型:8个专家模型动态路由实现 — Similar_Wealth_1850 · 2026-08-06
- 32个本地模型实测:F1分数掩盖的幻觉陷阱 — KitchenAmoeba4438 · 2026-08-06
- MiniMax H3 登顶三大视频生成榜单,超越字节与谷歌 — petewoodbridge · 2026-08-06
- VoxelBench 模型榜单:GPT-5.6 领跑,Kimi K3 夺得开源最佳 — legit_api · 2026-08-06