Claude 回答前先查了我是谁

wunderwuzzi23 · x · 2026-07-19

作者称,Claude 在回答关于 red teaming 的问题前,**先查了关于他本人的信息**,让他觉得有点“吓人”。 配图里显示模型在做类似“**在研究者可信度与攻击实现细节递进之间加权判断**”的处理,最后显示 Done。这个帖子更像是在分享一个**模型会主动利用背景信息来调整回答**的实例,引出隐私感和安全边界问题。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →