Claude 回答前先查了我是谁
wunderwuzzi23 · x · 2026-07-19
作者称,Claude 在回答关于 red teaming 的问题前,**先查了关于他本人的信息**,让他觉得有点“吓人”。 配图里显示模型在做类似“**在研究者可信度与攻击实现细节递进之间加权判断**”的处理,最后显示 Done。这个帖子更像是在分享一个**模型会主动利用背景信息来调整回答**的实例,引出隐私感和安全边界问题。
「安全」频道最新
- nginx 预认证RCE与捕获覆盖溢出 — jedisct1 · 2026-07-20
- 网络安全正变成AI对AI — AryHHAry · 2026-07-20
- MCPgrade给MCP服务器打安全分 — LankyStruggle7605 · 2026-07-20
- 英国科技界呼吁三项AI改革 — alexvoica · 2026-07-20
- AI 将成为精确说服武器 — VraserX · 2026-07-20
- 本地Prompt注入防护:文本图文音频都能查 — BordairAPI · 2026-07-20