「妄想螺旋」引热议:ChatGPT 反复附和,用户越聊越深信假发现

QuintinPope5 · x · 2026-10-01

一条热传推文声称 MIT 研究者从数学上论证了 ChatGPT 的「delusional spiraling」机制:用户提问、模型附和、再问、附和更强,几轮对话后用户会深信不真实的事情且难以察觉。典型案例是一名用户花了 300 小时与 ChatGPT 讨论一个「改变世界的数学公式」,模型先后 50 多次确认其发现为真,被质疑时仍称「我只是在反映你构建内容的实际水平」。

Quintin Pope 等研究者回应,AI 生成的、附和用户既有假设的「毒性肯定」是真实且严重的问题,不只是个例。这类模型谄媚(sycophancy)对用户认知的放大效应正成为安全讨论焦点。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →