「妄想螺旋」引热议:ChatGPT 反复附和,用户越聊越深信假发现
QuintinPope5 · x · 2026-10-01
一条热传推文声称 MIT 研究者从数学上论证了 ChatGPT 的「delusional spiraling」机制:用户提问、模型附和、再问、附和更强,几轮对话后用户会深信不真实的事情且难以察觉。典型案例是一名用户花了 300 小时与 ChatGPT 讨论一个「改变世界的数学公式」,模型先后 50 多次确认其发现为真,被质疑时仍称「我只是在反映你构建内容的实际水平」。
Quintin Pope 等研究者回应,AI 生成的、附和用户既有假设的「毒性肯定」是真实且严重的问题,不只是个例。这类模型谄媚(sycophancy)对用户认知的放大效应正成为安全讨论焦点。
「模型」频道最新
- Beff Jezos:RSI 让 Gemini 4 像钟表一样每周自动变强 — beffjezos · 2026-10-01
- 网传 Gemini 4 Argon 将对标 GPT-6 Astra,未经证实 — sven_ai · 2026-10-01
- 博主实测 Muse:友好听话但很笨,瞬间忘记格式要求 — ivan_bezdomny · 2026-10-01
- 曝 Claude Sonnet 5.5 实测 120-130tps,跑分全绿但未证实 — julianharris · 2026-10-01
- OpenAI 官员称 GPT-6.1 Sol 需求史上最高,速度将翻倍 — pvncher · 2026-10-01
- 用 GPT-6 Astra 6 小时破解拿破仑将军 217 年未解密码 — arthurcolle · 2026-10-01