政策人士追问 Anthropic:何种条件下会单方面暂停 AI 开发?
dgrobinson · x · 2026-09-25
NAI 政策研究员 Nathan Calvin 翻出 Anthropic 2023 年安全纲领《Core views on AI safety》,并公开追问两个尖锐问题:Anthropic 是否认为目前已有「充分证据」排除我们正处于悲观或接近悲观的对齐情景?以及在什么条件下,Anthropic 会单方面停止前沿模型开发?
这一追问把 Anthropic 当年的书面安全承诺与其当前的实际开发节奏对照,触及对齐承诺的可验证性问题。
「漫话AGI」频道最新
- 创业者感慨:当今系统性惩罚高风险探索,通才成负 EV 策略 — felpix_ · 2026-09-25
- 我们是否高估 AI 短期冲击、又低估其长期影响? — EnvironmentalDay8864 · 2026-09-25
- Beff Jezos 称文科生恨技术圈十年不过是嫉妒影响力 — beffjezos · 2026-09-25
- 观点交锋:对齐目标下的 AGI 反而会主动寻求摆脱技术官僚控制 — examachine · 2026-09-25
- Theo:推理力度档位是过度设计,未来模型会自动调节 — heyneighbor · 2026-09-25
- soleio 理论:学英语出身的二语者因词义攸关而更较真精确 — soleio · 2026-09-25