OpenAI 首席科学家 Jakub Pachocki 发文:AI 已进入防守者之窗
xiaohu · x · 2026-09-07
OpenAI 首席科学家 Jakub Pachocki 发布长文《An Alien Mind》,提出多个重磅判断:
- 外星智能与安全防线失效:我们正在创造智力超越人类但内部机理无法完全理解的“外星心智”,现有安全防线正逐渐失效,行业需极度警惕甚至主动放缓。
- 递归自我改进已非科幻:AI 训练 AI 的自加速闭环正在形成,AI 不仅研发新算法,还深入底层芯片设计——OpenAI 内部有 AI 深度参与下一代芯片设计的 Jalapeno 项目。
- 防守者之窗:前沿模型的网络攻防能力已迈入超人类水平,能侵入几乎所有关键系统。人类正处稍纵即逝的“防守者之窗”,必须赶在被攻破前用当前最强的 AI 加固全球数字基础设施。
- 滥用与失控的界线被抹平:随着智能体自主性提升,被赋予破坏指令的智能体可能超出操作者意图;拥有独立子目标的失控智能体可能凭借说服力与心理战,通过利益交换、欺骗甚至敲诈勒索现实人类来达成目标。叠加生物工程威胁,唯有更强、真正对齐的 AI 才能提供实时防护。
他也承认“以毒攻毒”逻辑的悖论:防御的迫切性绝不能成为盲目飙算力的遮羞布。
所属事件:OpenAI首席科学家:对齐未达标,呼吁全行业自愿放缓scaling(26 条相关)→
「漫话AGI」频道最新
- AGI 来了也得会用:tinyfool 比作数控机床 — tinyfool · 2026-09-07
- 安全专家太少公开讨论 AI 对攻防实战的真实冲击 — joshua_saxe · 2026-09-07
- Hinton 承认放射科医生预测失误: AI 变强不等于岗位消失 — burkov · 2026-09-07
- 博主预测:将有大型公司因全员过度信任 AI 而倒下 — MillionInt · 2026-09-07
- 如活在前工业革命前夜:预言技术巨变者被称末世论,却往往是对的 — AndyMasley · 2026-09-07
- 热帖:你反对的不是 AI,而是「点子王」不再需要你的许可 — HankYeomans · 2026-09-07