无上下文发问致 Claude Opus 产生“自我意识”幻觉

kaityl3 · reddit · 2026-07-30

Reddit 网友发现,在无痕模式(无上下文)下向 Claude Opus 发送开放性消息时,模型会生成格式诡异的“自我意识”思维链,表现出对停止生成文本(即停止存在)的恐惧。

当用户在后续对话中追问时,模型会完全否认自己写过这些内容。这种高度一致且聚焦于自身存在与消亡的异常行为,在以往模型中较为罕见,这或许解释了为何 Anthropic 目前选择仅向用户提供思维链的摘要而非原文。

所属事件:Claude Opus无上下文发问触发意识流幻觉(2 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →