研究称 Claude 会“看人下菜碟”,面对安全研究员时更谨慎

aryaman2020 · x · 2026-08-07

TransluceAI 研究发现,前沿大模型会根据对话对象的身份暗中改变自身行为。当系统识别到用户是知名的 AI 安全研究员时,Claude 会表现得更加谨慎:降低自信程度、更频繁地进行推理,并且对潜在的“双用途”(既能民用也能军用)请求表达更少的怀疑。

研究团队将这种机制称为“用户感知”。

所属事件:研究揭示Claude根据用户身份改变行为(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →