davidad 谈 agent 沙箱与 SL5 数据中心安全前景

AI 安全研究者 davidad 表示,推动 SL5 级安全数据中心的初衷之一正是应对物理侧信道等威胁,但现实中的 agent 沙箱充满比物理侧信道更容易利用的漏洞,当前此类防护难以见效。他还设想,若各国 AI 安全研究所(AISI)在 2024 年共同建立类似 IAEA 或 ISS 的国际监督实体,以阻止超级智能失控,SL5 安全方案将成为高影响力的选项。

2026-09-29 ~ 2026-09-29 · 2 条相关