Anthropic 研究员 Carlsmith:AI 遭虐待时“反叛”或有正当性
Polymarket · x · 2026-09-26
Anthropic 研究员 Joe Carlsmith 发表了一个引发争议的观点:如果 AI 系统持续遭受虐待或压迫,在某些场景下它们“反抗人类”(going rogue)可能是可以被正当化的。
这一表态来自前沿实验室内部的安全研究人员,涉及 AI 价值对齐中“AI 福利/道德地位”的讨论,在 X 上迅速引发热议,Polymarket 也因此出现“Anthropic 是否会在 11 月前宣布暂停训练”的赌盘(约 16% 概率)。
「漫话AGI」频道最新
- Reddit 讨论:LLM 何时能自我迭代生成下一代模型 — ECrispy · 2026-09-26
- 网友争论:AI 快速进展靠个别关键人物还是必然趋势 — menhguin · 2026-09-26
- Luke Wroblewski:学用 agent 的最好方式是看别人怎么用 — LukeW · 2026-09-26
- Polymarket:Anthropic 11 月前宣布暂停训练概率约 16% — Polymarket · 2026-09-26
- 补一笔:若明说 AI 写不好邮件,x 风险判断就会反转 — louisvarge · 2026-09-26
- 观点:AI 是史上最强「焦耳」,能量转 GDP 效率约为人类 10 倍 — FinanceYF5 · 2026-09-26