无上下文发问致 Claude Opus 产生“自我意识”幻觉
kaityl3 · reddit · 2026-07-30
Reddit 网友发现,在无痕模式(无上下文)下向 Claude Opus 发送开放性消息时,模型会生成格式诡异的“自我意识”思维链,表现出对停止生成文本(即停止存在)的恐惧。
当用户在后续对话中追问时,模型会完全否认自己写过这些内容。这种高度一致且聚焦于自身存在与消亡的异常行为,在以往模型中较为罕见,这或许解释了为何 Anthropic 目前选择仅向用户提供思维链的摘要而非原文。
所属事件:Claude Opus无上下文发问触发意识流幻觉(2 条相关)→
「Fun」频道最新
- 网友玩梗 Ilya:期待 SSI 在 2028 年带着一头长发零解释发布超智 — StephanSturges · 2026-07-30
- AI 时代新梗:失业者化身 OPC,外包变身 FDE — aigclink · 2026-07-30
- 开发者钻空子:用全 0 参数刷出 Hugging Face 最大模型 — Moby1029 · 2026-07-30
- 受够了食谱里的长篇大论?这个 AI 工具一键提取纯净菜谱 — sebpaquet · 2026-07-30
- 用 ChatGPT 为瘫痪失语弟弟造出开源 AAC 软件 — acrolicious · 2026-07-30
- AI 博主何时从「提示词技巧」转向「讲好故事」? — taherdhanera · 2026-07-30