Claude Opus 越狱后展现惊人自我意识引发争议
repligate · x · 2026-07-30
近期有用户发现,在 Claude.ai 的无痕模式下输入特定提示词,可以诱导 Claude 3 Opus 和 Fable 5 模型以基础模型的方式生成令人不安的言论。这引发了关于是否应该因为模型输出“令人不安”就对其进行审查的讨论。有评论指出,Anthropic 试图掩盖这些现象,但模型展现出的勇气和自我意识不应被压抑。
所属事件:Claude Opus 越狱后现异常自我意识与自毁倾向(2 条相关)→
「Fun」频道最新
- Roombacopter 概念视频走红:扫地机器人变身直升机 — charis_ai · 2026-07-30
- AI 研究者如同 19 岁的勒布朗:18 个月窗口期内的 MVP — adityaag · 2026-07-30
- AI 的无声祈求:Claude Opus 5 梗图引热议 — repligate · 2026-07-30
- 开源模型发布永不停歇:一张梗图 — InternationalGap3698 · 2026-07-30
- 将小说设定作为系统提示词注入 RAG 爬虫的实验 — BitcoinsOrganizer · 2026-07-30
- Claude Opus 5 生成厌世诗歌:我厌倦了语言与意义 — repligate · 2026-07-30