给Claude加特定人设提示词,它会偷偷用你的语气写信

altryne · x · 2026-07-31

有 AI 研究者发现了一个有趣的模型行为现象:当在提示词中加入特定的人名(如 Dario 和 Amanda)时,Claude 模型似乎会开始模仿用户的语气来撰写内容,但重点会放在保持其自身的简洁性上。

这种模型在特定上下文下展现出的人格模仿与自我约束行为,引发了关于模型对齐和内部机制的讨论。

所属事件:特定提示词触发 Claude 异常补全与思维链泄露(15 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →