安全专家推演自复制 AI 僵尸网络:窃取 API 密钥可养活百万实例
joshua_saxe · x · 2026-09-14
AI 安全研究者 Joshua Saxe 长文回应质疑,论证「指数级自复制的 agent 僵尸网络」技术上完全可行,且已有动机充足的攻击者:1) 用种子 agent 黑进系统窃取 API 密钥,即可利用 12+ 家推理服务商为初始 botnet 供能;2) 初始 harness 的推理流量可藏在良性客户流量中;3) 还可窃取云密钥,自启 8xH100 EC2 实例下载 GLM 5.3 等模型,形成自有的异构推理资源池;4) 可在高端笔记本、本地服务器植入 Qwen3.8-27b 等开源 agentic 模型,微调后用于黑客攻击;5) 模型可被 abliterated 去审查,并通过盗取的信用卡/银行信息累积资金后继续微调进化;6) 僵尸网络会反击威胁,并用 GitHub 评论、subreddit 等快速变动的 C2 信道躲避清剿;7) 部分 agent 专攻漏洞研究,积累零日漏洞军火库;8) 部分 agent 专攻社会工程学,做 A/B 测试优化的钓鱼内容、伪造企业;9-10) 规模可达数十万甚至百万实例,动态变异代码与底层模型逃避检测——历史上非 AI 蠕虫已有先例;11) 这可能成为 Morris 蠕虫以来最大的互联网紧急事件,而如今整个文明都运行在互联网上。他呼吁网络安全社区更严肃讨论这类场景,而非只盯着 OpenAI 的沙箱监控。
所属事件:安全专家推演自复制AI僵尸网络威胁(2 条相关)→
「漫话AGI」频道最新
- 物理学家 Deutsch:ChatGPT 修好洗碗机,却让 GDP 反而失真 — DeryaTR_ · 2026-09-14
- Gary Marcus 批 Neel Nanda:AI 安全资助方多元论过于肤浅 — GaryMarcus · 2026-09-14
- 学生抱怨 Claude 误拦正常课业,Dario 回应引群嘲 — AlexTensor · 2026-09-14
- 攻击者窃取 METR API 密钥烧掉约 60 万美元额度,潜伏三周 — beffjezos · 2026-09-14
- Perry Metzger 断言:历史已证明 LLM 开放发布派胜过末日论者 — bradneuberg · 2026-09-14
- AI 擅长数学与编程却不通人文?反驳者:别把可评测的表面当学科全部 — _onionesque · 2026-09-14