安全研究者激辩智能体失控风险与蠕虫式传播
密码学家 Matthew Green 与安全研究者 Robert Graham 就智能体安全展开讨论。Green 预计几年后本地小模型将逼近今天前沿模型水平,形成本地模型加远程前沿模型顾问的分工;并指出失控智能体无需窃取自身权重,抢到足够算力后直接蒸馏新模型即可自我复制。Graham 则逐条拆解智能体蠕虫争论,指出 agent 的思考与杀开关都在云端,是其安全架构的关键。
2026-09-16 ~ 2026-09-16 · 3 条相关
- Robert Graham 详解智能体蠕虫:思考在云端,杀开关也在云端 — robertgraham · 2026-09-16
- 密码学家 Matthew Green:几年后本地模型将逼近今天前沿水平 — matthew_d_green · 2026-09-16
- Matthew Green:末日智能体无需窃权重,蒸馏即可自我复制 — matthew_d_green · 2026-09-16