AI 安全人士预测:年底前至少两家前沿公司将单方面作出安全承诺
Miles_Brundage · x · 2026-09-19
AI 安全研究者 MackenZ Arnold 公开记录自己对前沿 AI 公司安全承诺的预测:
- 年底前至少两家前沿公司将单方面作出安全承诺,舆论共识会是「方向对、范围窄、还不够」
- 承诺会包含真正有用的部分(技术监督与监控类),但不会包含:分级发布系统、不安全事件后的限制或延期、安全流程失效披露、对某些技术(如不可读 CoT)的限制;事件披露条款会较软弱
- 一年内至少一家公司会因预计将违反承诺而修订条款,至少另外两家实质违背承诺精神
这是对前沿公司自律承诺走向的具体押注,值得后续对照验证。
「漫话AGI」频道最新
- Polymarket:今日多数网络文章首次沦为「AI slop」 — Polymarket · 2026-09-19
- Pedro Domingos:反对数据中心就是让国家变蠢 — pmddomingos · 2026-09-19
- Tyler Cowen 称 AI 是人类史上前十大事,Zvi 自认 maximally skeptical — TheZvi · 2026-09-19
- Sentdex:自动驾驶真正的难点是感知层,不是决策 — Sentdex · 2026-09-19
- Turing Post 长文拆解:AI 改进 AI 为何大多不是真递归自我改进 — TheTuringPost · 2026-09-19
- Gary Marcus 反驳 AI 末日论:AI 不是自然力量,人类始终握有主导权 — GaryMarcus · 2026-09-19