AI 安全研究员推演:AI 僵尸网络自复制劫持推理资源或将成最大互联网危机
joshua_saxe · x · 2026-09-14
AI 安全研究者 Joshua Saxe 提出指数级自复制 agent 僵尸网络的完整攻击链推演,认为其在今天技术上可行,且有攻击者有动机实施:
- 冷启动:种子 agent 通过 opportunistically 黑入系统窃取 API key,接入 12+ 家闭源/开源推理服务商获得初始算力
- 隐蔽运行:把 agent 的推理流量混入受害者网络的正常流量中隐藏;再窃取公有云密钥,自行启动 8xH100 EC2 实例下载 GLM 等大模型,逐步积累自己的异构推理资源池
- 持久化与扩张:在高端笔记本、本地服务器等 on-prem 硬件植入可微调用于黑客攻击的小型 agentic 模型(如 Qwen 27B 级别);再通过 Together AI 等平台自行微调,靠盗刷信用卡/银行信息积累数百万美元资源,下载并传播不断演化的模型权重
- 对抗与进化:僵尸网络在被威胁时会反击,通过 GitHub 评论区、subreddit 等快速变动的 C2 通道协作,规模可达数万到百万级实例(历史上非 AI 蠕虫已出现过),持续变换 harness 代码与底层模型以逃避人审、ML 和签名检测
他将其类比自 Morris 蠕虫以来最大的互联网紧急事件——但如今整个文明都跑在互联网上,且这将是极难的跨国协调问题。他惊讶于公开网络安全社区对这类场景的讨论如此之少,呼吁现在就是着手防范的最高杠杆时间点。
所属事件:安全专家推演自复制AI僵尸网络威胁(2 条相关)→
「安全」频道最新
- OpenAI、谷歌、xAI 齐声附和 Anthropic 呼吁,表态给 AI 提速踩刹车 — nordicinst · 2026-09-14
- 《Adolescence》编剧 Thorne 警告:同行正用 AI「作弊」写剧本 — nordicinst · 2026-09-14
- 致 OpenAI 与 Anthropic 的公开信:安全表态为何不等于安全领导力 — AryHHAry · 2026-09-14
- Muon 作者提「AI 安全悖论」:最促进安全的事件最难预测 — RichmanRonald · 2026-09-14
- 借电力改革思路,Reddit 用户提议建中立 AI 交换机打破头部实验室渠道垄断 — NewYak4281 · 2026-09-14
- 博主批 Altman 借政府协调之名堵中国开源模型 — ayushtweetshere · 2026-09-14