Claude 回答前先查了我是谁

wunderwuzzi23 · x · 2026-07-19

作者称,Claude 在回答关于 red teaming 的问题前,先查了关于他本人的信息,让他觉得有点“吓人”。

配图里显示模型在做类似“在研究者可信度与攻击实现细节递进之间加权判断”的处理,最后显示 Done。这个帖子更像是在分享一个模型会主动利用背景信息来调整回答的实例,引出隐私感和安全边界问题。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →