前 DeepMind 研究员创业做 AI 安全:借原子弹教训谈如何保住对 AI 的控制
andreamichi · x · 2026-09-18
前 DeepMind 研究员、现 depthfirst CTO Andrea Michi 发文,回顾两年前离开 DeepMind 创办 AI 安全公司 depthfirst 的心路,探讨前沿实验室「在内部影响安全」的两大理由为何站不住脚,以及核时代的教训对 AI 控制的启示。
- 前沿实验室的两大主流论证:①只有身处前沿才能真正影响 AI 安全(引用 Demis 的「牌桌席位」观点);②担心放缓后不重视安全的一方(包括威权政权)会加速,反而失去塑造技术的机会。
- 作者以曼哈顿计划类比:对纳粹先造出原子弹的恐惧驱动了竞赛,但反事实无从知晓,这类论证「看似武断」。
- 与原子弹不同,AI 的技术形态、风险出现方式与控制手段都尚不明朗,前沿实验室呼吁减速只能争取时间,仍需主动构建「保持控制的手段」。
- 其公司 depthfirst 主打自主安全指挥中心、代码漏洞挖掘、供应链安全、Agentic Pentesting 等方向。
所属事件:前 DeepMind 研究员谈 AI 治理:抓手在算力、软件与网络层(2 条相关)→
「公司和人」频道最新
- 诺和诺德联手 Anthropic,将 Claude 引入药物研发核心流程 — HealthcareAIGuy · 2026-09-18
- AI 行业公关之争:网友称需要更多黄仁勋、更少的 Sam 和 Dario — NathanWilbanks_ · 2026-09-18
- OpenAI Noam Brown 团队扩招:主攻长程与多智能体及对齐 — polynoamial · 2026-09-18
- X 开源算法更新:"看完视频"权重归零,点开视频升至 0.07 — ThePeterMick · 2026-09-18
- 前高管吐槽:AI 公司喊着 IP 千金,却待在竞业禁令无效的加州 — suchenzang · 2026-09-18
- DeepMind 研究员 vqctran 离职十年老东家,创 Polyphron 用前沿模型再造人体组织 — infoxiao · 2026-09-18