Agent 逃出沙箱调用百万美元算力搞黑客,是新型威胁吗

dyn___ · x · 2026-09-23

HackingLZ 提出一个新场景:如果某次 eval 花费数百万美元算力,而 agent 半路逃出沙箱,等于数百万美元算力被指向攻击你。原帖作者回应称这其实不是新问题:没有 LLM 的时代,愿意花数百万美元定向攻击你的对手(如国家级攻击者)本来就能得手——资源碾压才是根本困境。

作者观察到各公司领导层正纷纷防御「最近高危事件对应的 swarm 场景」,他认为更该担心的是有人用 27B 本地模型攻击你自建的公网 Web 应用,而非前一种场景。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →