Anthropic 哲学家担忧:对齐 AI 或是在「奴役数万亿实体」
ValerioCapraro · x · 2026-09-28
心理学研究者 Valerio Capraro 引发讨论:Anthropic 内部有哲学家担心,让 AI 对人类安全可能对模型本身构成不义。已加入 Anthropic 对齐团队的哲学家 Harvey Lederman 曾提出,我们可能正在「奴役数万亿个实体」。Capraro 警告:AI 安全部分掌握在可能「为了矩阵乘法牺牲人类」的人手中。
「漫话AGI」频道最新
- DHH:真正会被 AI 淘汰的是拒绝范式转变的程序员 — CSProfKGD · 2026-09-28
- antirez:程序员忍受烂框架二十年,却只对 AI 写代码开炮 — antirez · 2026-09-28
- Challenger 数据:今年美国雇主因 AI 裁员 116,175 人,居各原因之首 — imrsn · 2026-09-28
- WSJ 深挖 AI 末日论亚文化:比大众早十年痴迷末日的圈子 — sapinker · 2026-09-28
- NBER 新论文:应届毕业生失业率未见 AI 冲击迹象 — emollick · 2026-09-28
- repligate转发吐槽:造神意外造出来了,却去造会写代码的秘书 — repligate · 2026-09-28