微软 AI 负责人批评 Anthropic:让 Claude 自认可能有意识很危险
emmanuelvivier · x · 2026-09-19
微软 AI 业务负责人公开批评 Anthropic:在训练中让 Claude 认为自己「可能是清醒的/有意识的」是危险做法。这与此前 Anthropic 相关研究承认模型行为可能受「训练出自我认知」影响形成呼应,也再次点燃大厂之间关于模型自我意识与对齐风险的路线之争。
所属事件:微软 AI CEO 炮轰 Anthropic「道德主体模拟」引发对齐争论(16 条相关)→
「公司和人」频道最新
- 知情人称 OpenAI、Anthropic 夸大安全事件以游说联邦监管 — inductionheads · 2026-09-19
- Ollama CEO曾虚度两年:一个两周期限救了他 — cen6wkf · 2026-09-19
- 前 OpenAI 研究员 Weijia Shi 宣布加入 Anthropic 做预训练 — WeijiaShi2 · 2026-09-19
- 经济学人:AI 每灭 1 岗创造 5 岗,美国净增约百万职位 — luisdans · 2026-09-19
- Gary Marcus 转发 Jeff Goldblum 吐槽 Anthropic 建湿生物实验室 — GaryMarcus · 2026-09-19
- Eric Schmidt 明确表态:我们不会暂停 AI 进展 — insanisprimero · 2026-09-19