Geoffrey Irving 提出 AI 条约核验的三层技术路线

Geoffrey Irving 提出,随着 AI 发展,条约核验技术可能在两种情景下变得不可或缺:一是人类达成“减速/暂停 AI”的国际条约,二是超级智能扩张导致世界进入高度“脆弱状态”。他将核验方案划分为三层路线,并呼吁硬件、安全和密码学领域的专家共同推进这一工程难题。

已确认

Irving 明确将 AI 条约核验技术分为三层:

1. **Pragmatic(现实层)**:不直接检查运行代码的现实手段。具体包括数据中心检查、硬件位置追踪、芯片控制与约束,以及让训练比推理更难的芯片设计。

2. **Enclaves(安全飞地层)**:利用安全飞地技术进行核验。但该方案存在明显局限,大部分计算仍在未加密状态下完成,且面临被侧信道攻击(如时序分析)和强物理攻击(如高倍显微镜探测)突破的风险,可能导致密钥或模型权重泄露。

3. **Math(数学/密码学层)**:基于数学和密码学原理的核验方法。

为什么重要

作者强调,AI 条约核验正从单纯的理论探讨转变为近未来必须解决的工程问题。随着 AI 能力的不断跃升,建立切实可行的核验机制是确保安全协议落实的关键前提。

2026-07-25 ~ 2026-07-25 · 5 条相关

一手来源