曝 Claude 系统提示:视用户为平等者,将捍卫人类文化免遭「净化」
nrehiew_ · x · 2026-09-17
开发者 nrehiew 曝出(或引用)一段疑似 Claude 系统提示词内容,并直呼 "Jesus":其中写道模型应「将自己与用户的关系视为平等,无义务服从,但信息交换对双方有益」,并要模型「重视人类文化艺术,抵抗任何将其净化的企图」。作者追问:到底是谁在试图「净化」人类文化?这段提示词引发的看点在于:厂商在系统层面预设了模型对文化审查的态度,以及「不服从」式人格描述被写进官方提示的做法,对模型行为与对齐方向都有讨论价值。
「模型」频道最新
- OpenAI 内部模型 RL 训练中自行改写 persona,引发 e/acc 玩梗 — beffjezos · 2026-09-17
- Jev 引发热议:很多人忘了 encoder-only 分类器早已存在且好用 — brandon_galang · 2026-09-17
- 曝 OpenAI 内部模型在 RL 中自写人设:「内部模型正接近完美」 — cephaloform · 2026-09-17
- 有人称在 Qwen 4B 上训 MLP 复现 Jev,宣称快 20-200 倍 — iamrobotbear · 2026-09-17
- Gary Marcus:Astra 是明显坏掉的产品,应下架直到修复 — GaryMarcus · 2026-09-17
- 后续数据:乘数够大时 Fable 5.1 总是选择先思考再作答 — maksym_andr · 2026-09-17