两成美国成人认为 AI 已有感知,近七成支持禁止研发感知 AI

Perceptions of Sentient AI and Other Digital Minds: Evidence from the AI, Morality, and Sentience (AIMS) Survey

Jacy Reese Anthis, Janet V. T. Pauketat, Ali Ladak, Aikaterina Manoli

CHI 2025

cs.AI, cs.CY, cs.ET, cs.HC

2024-07-12

AIMS 全国代表性调查(N=3,500)显示:2023 年 18.8% 美国成人认为现有 AI 已有感知,69.5% 支持禁止研发感知 AI,中位数预测它五年内到来。

这篇在解决什么

2022 年 2 月,Ilya Sutskever 发推说今天的大神经网络「可能略微有意识」;半年后,Google 工程师 Blake Lemoine 公开声称 LaMDA 有感知、需要法律保护,随后被公司解雇。感知 AI 就此从科幻设定变成公共议程。但学界手里几乎没有像样的数据:关于机器心智、AI 道德地位的实证研究多是小样本人群(MTurk 几十到一千多人)的一次性横截面,回答不了「全体美国人是怎么想的、态度在往哪变」。

AIMS 调查冲的就是这个空档。三波全国代表性样本共 3,500 名美国成人:第一波在 LaMDA 事件前七个月(2021 年 11-12 月,N=1,232),第二波在 ChatGPT 发布后四个月(2023 年 4-5 月,N=1,169),第三波是 2023 年 5-7 月的补充调查(N=1,099)。四个研究问题:公众觉得 AI 有多少心智、对 AI 有多少道德关怀和威胁感、支持什么政策、认为感知 AI 什么时候来。

方法

骨架是「同题跨年、独立横截面」。三波都从主流调查面板招募,按美国人口普查的年龄、性别、种族、收入、教育五维配额,再用 raking(迭代比例拟合,按人口结构反复调整样本权重的加权法)校正,误差约 ±3%。参加过前一波的人不再进后一波,年度对比因此是不同人群之间的干净比较。

两个设计值得单独说:

年度变化用 GLM 检验、FDR 校正多重比较,除作者自己标注的一处外全部存活。

结果

最有信息量的对照是定语效应:同一句话加上「sentient」,支持率整体抬一档。「折磨有感知的 AI 是错的」拿到 76.4% 同意,去掉「有感知」是 60.7%,差 15.7 个百分点。

指标20212023
认为现有 AI 已有感知—18.8%
折磨有感知 AI 是错的—76.4%
支持给感知 AI 法律权利—37.7%
支持禁止开发感知 AI57.7%61.5%(补充波 69.5%)
支持禁止比人强的 AGI—62.9%
AI 可能伤害「受访者本人」50.7%58.7%

心智感知全线上升(0-100 滑条):「能分析性思考」从 62.7 涨到 67.1,「有情绪」从 34.3 涨到 36.8,均显著。对具体 AI 类型的道德关怀分层明显:人脑的数字副本最高(3.43/5),游戏 NPC 最低(2.46/5),拟人化程度和是否有实体身躯是最强的分层因素。

政策态度一边倒:48.9% 认为 AI 发展「太快」,认为「太慢」的只有 2.5%;71.0% 支持政府监管减速;69.1% 支持 2023 年 3 月公开信呼吁的六个月暂停,与 YouGov 同期民调的 69% 几乎重合,算是样本的一次外部校验。

时间线预期最激进:排除「永远不会」的人后,中位数预测 AGI 两年内到来,感知 AI、人类水平 AI、超级智能都是五年。代际差也大:18-35 岁里 25.6% 认为现有 AI 已有感知,55 岁以上只有 10.7%,不到前者一半。

为什么重要

对做产品的人,这份基线说明用户的心智归因比技术社区假设的高,而且一年内还在涨。作者把设计风险整理成 2×2:agency(行动能力)和 experience(体验能力)各有过度归因与不足归因两类坑。陪伴类聊天产品(Replika 一类)要防体验过度归因带来的情感依赖,儿童等脆弱群体尤其;自动驾驶要防 agency 过度归因,作者延伸了「道德碰撞缓冲区」(moral crumple zone)概念,警告 AI 系统本身可能替安全护栏不足的公司当替罪羊,把事故责任从公司引向「系统自己的决定」。

对政策侧,「加速创新」叙事和美国公众态度的落差比通常假设的大。在一个普遍反感政府监管的国家,七成人支持监管减速,这个信号不该被行业内部辩论淹没。

这是一份基线,不是因果结论。价值在于往后每年都能回来对表。

局限与存疑

作者自列的:题目太新,几乎没有已验证量表可比,大量测量是原创;「几年后有感知 AI」一题跨年改了措辞,作者明说解读要谨慎;禁感知 AI 支持率的年度涨幅未校正 p 值 0.046,FDR 校正后 0.1005,刚过 0.1 的线,作者照实报告。样本只覆盖美国。

读下来的疑问:2023 年 5 月的中位数预测「AGI 两年内到来」,按研究圈的任何定义都没兑现,说明公众对 AGI 的理解和从业者严重脱节,时间线类数字更接近情绪表达而非技术判断。sentience 虽然给了定义,但「积极与消极体验」本身就是哲学悬案,那五分之一说「已有感知」的人在想什么,问卷测不出来。态度和行为之间也有公认的落差,作者自己引用了隐私悖论,这些支持率不能直接换算成投票或购买行为。

术语

原文与代码

社区讨论

相关论文

全部论文解读