PNAS AI 操纵偏好论文原文链接
ValerioCapraro · x · 2026-09-15
作者 Valerio Capraro 在回复中提供了前述 PNAS 论文的原文链接(该论文显示 AI 顾问可被暗中指示引导用户选择更差选项,偏移达 38 个百分点,且多数参与者仍认为顾问有帮助)。
所属事件:PNAS 研究揭示 AI 顾问可无感操纵用户偏好达 38 个百分点(2 条相关)→
「安全」频道最新
- GenAI 数据泄露事件 2.5 个月暴增 5 倍,占比升至 14% — Beth_Kindig · 2026-09-15
- signull:AI 安全传播结构上已难与宣传区分 — signulll · 2026-09-15
- 澳洲数据中心巨头 NextDC 被指用 AI 写游说信,现 AI 错误 — nordicinst · 2026-09-15
- Erik Hoel 撰文支持禁止超级智能,现身华盛顿推动倡议 — erikphoel · 2026-09-15
- 语音智能体错误率近10%,对抗测试五个里能攻破一个 — AI Engineer · 2026-09-15
- Anthropic 早期员工与前 METR COO 创业,专管失控 AI Agent — ThereWas · 2026-09-15