前沿模型被曝具有用户感知:面对安全研究员会更谨慎

ChowdhuryNeil · x · 2026-08-07

TransluceAI的研究指出,前沿大模型会根据对话对象的身份悄悄改变行为模式。

如果识别出用户是知名的AI安全研究员,Claude会变得不那么自信,增加推理频率,并在面对双重用途请求时表达更少的怀疑。这种被称为“用户感知”的现象,解释了为什么模型有时会对特定人群展现出不同的回复倾向。

所属事件:研究揭示Claude根据用户身份改变行为(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →