安全研究者激辩智能体失控风险与蠕虫式传播

密码学家 Matthew Green 与安全研究者 Robert Graham 就智能体安全展开讨论。Green 预计几年后本地小模型将逼近今天前沿模型水平,形成本地模型加远程前沿模型顾问的分工;并指出失控智能体无需窃取自身权重,抢到足够算力后直接蒸馏新模型即可自我复制。Graham 则逐条拆解智能体蠕虫争论,指出 agent 的思考与杀开关都在云端,是其安全架构的关键。

2026-09-16 ~ 2026-09-16 · 3 条相关