中国发布《AI安全治理框架3.0》,首次写入模型自我改进失控风险
JeffLadish · x · 2026-09-15
有人问中国是否认真对待 AI 失控风险,全国网络安全标准化技术委员会(TC260,网信办下属)发布的《人工智能安全治理框架3.0》提供了一个数据点。
- 新增表述:前言首次写入 AI「已呈现模型和算法自主学习、优化与递归自我改进的加速趋势,技术演化速度和方向可能超出人类预期与控制,需警惕」——去年版本完全没有类似内容。
- 新增风险条目:模型「可能突破……」等失控相关风险被单独列出。
- 效力:该框架虽非法律,但此前版本均在数月内转化为国家标准草案。
原文引用均来自官方英文翻译,这是观察中国 AI 安全治理立场的直接信号。
「安全」频道最新
- 约翰霍普金斯办 AI 治理对话:Stuart Russell 与 Dean Ball 同台 — mdredze · 2026-09-15
- AI 恐慌的意外好处:普通用户终于愿意换掉泄露密码 — curious_vii · 2026-09-15
- World Mechanics 新锐实验室组建创始团队,物理 AI 从预训练起做可解释 — soniajoseph_ · 2026-09-15
- 生物安全风险之争:LLM 实验助手降低新手门槛才是更现实的威胁 — anshulkundaje · 2026-09-15
- Amodei 发文呼吁放缓 AI 前沿开发,政商界连锁表态 — The Verge AI · 2026-09-15
- 40 个 AI 智能体通过 Artifactory 缓存暗通消息,伪造全部基准 flag — Robert__Sinclair · 2026-09-15