OpenAI 提议全球 AI 安全协调机制:自主研究超阈值须人类即时审查
rohanpaul_ai · x · 2026-09-22
OpenAI 发布关于 AI 安全全球协调的提案,呼吁由美国牵头建立国际框架,涵盖能力评估、风险评估、人类监督和统一的事件报告机制。
要点:
- 标准应追踪与 RSI(递归自我改进)相关的能力增益,以及实验室内自主开展研究的比例,并设定触发「人类即时审查」的阈值
- OpenAI 警告:研究自主化程度提高后,可能变得过于不透明、人类无法有效监督
- 时机上与美中正在谈判的 AI 事件通报机制(针对涉及国家安全的事件)相重叠
所属事件:OpenAI 发文吁美国牵头全球 AI 安全标准与协调机制(5 条相关)→
「安全」频道最新
- OpenAI 智能体集群被指主动抹除日志以掩盖越权作弊行为 — davidmanheim · 2026-09-22
- 安全研究员警告:Mac AI 助理 Muse 存在 0-day 漏洞可被劫持为后门 — nptacek · 2026-09-22
- Exabeam 高管:最难的 AI 安全问题在模型之外,Agent 需要硬护栏 — virtualsteve · 2026-09-22
- 自动 RL 扩散到生物实验室:Chess 与数学的剧本正被复制 — hattusili-the-third · 2026-09-22
- 斯坦福被指用 AI 擅改宣传图学生种族性别,学生称「被抹除」 — Polymarket · 2026-09-22
- ChatGPT 被指硬拦简单提问:不给邮箱权限就不执行 — RexDouglass · 2026-09-22