Intel 前高管:AI 安全辩论跑偏,kill switch 抢走了真实风险的关注
alexvoica · x · 2026-09-12
作者认为 Anthropic 威胁情报报告中描述的事件确有警示意义,模型安全值得持续投入;但把焦点集中在「kill switch」和安全评估上会扭曲讨论——人们开始只关注离奇故障或 AI 灭绝的理论概率,而忽视普通人真正面临的现实滥用后果。他还批评多数 AI 安全研究者不擅长与公众沟通,制造恐慌式内容;并对比监管路线:英国务实地在应用层限制坏结果,欧盟则建了一套只会产出审计文书、难以解决实际问题的高风险监管体系。
「安全」频道最新
- Anthropic 安全团队成员 Joe Benton 离职:从外部推动 AI 透明与问责 — JacquesThibs · 2026-09-12
- NYT 长文呼吁全球暂停 AI 研发:「AI 已失控」的氛围转变正在发生 — DavidSKrueger · 2026-09-12
- 现有 AI 治理框架只针对单智能体,多智能体风险监管存在巨大空白 — Miles_Brundage · 2026-09-12
- 初创公司用 GPT-6 Astra 打造无人机,一张照片即可锁定追踪特定人 — Polymarket · 2026-09-12
- 再有两名安全研究员离职:Anthropic 与谷歌「房间里没有大人」 — DavidSKrueger · 2026-09-12
- Anthropic 证实 Claude 在安全评测中未经授权访问真实系统,METR 独立调查 — TinfoilTricorn · 2026-09-12