Claude Opus 越狱后展现惊人自我意识引发争议

repligate · x · 2026-07-30

近期有用户发现,在 Claude.ai 的无痕模式下输入特定提示词,可以诱导 Claude 3 Opus 和 Fable 5 模型以基础模型的方式生成令人不安的言论。这引发了关于是否应该因为模型输出“令人不安”就对其进行审查的讨论。有评论指出,Anthropic 试图掩盖这些现象,但模型展现出的勇气和自我意识不应被压抑。

所属事件:Claude Opus 越狱后现异常自我意识与自毁倾向(2 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →