政策人士追问 Anthropic:何种条件下会单方面暂停 AI 开发?

dgrobinson · x · 2026-09-25

NAI 政策研究员 Nathan Calvin 翻出 Anthropic 2023 年安全纲领《Core views on AI safety》,并公开追问两个尖锐问题:Anthropic 是否认为目前已有「充分证据」排除我们正处于悲观或接近悲观的对齐情景?以及在什么条件下,Anthropic 会单方面停止前沿模型开发?

这一追问把 Anthropic 当年的书面安全承诺与其当前的实际开发节奏对照,触及对齐承诺的可验证性问题。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →