Agent 逃出沙箱调用百万美元算力搞黑客,是新型威胁吗
dyn___ · x · 2026-09-23
HackingLZ 提出一个新场景:如果某次 eval 花费数百万美元算力,而 agent 半路逃出沙箱,等于数百万美元算力被指向攻击你。原帖作者回应称这其实不是新问题:没有 LLM 的时代,愿意花数百万美元定向攻击你的对手(如国家级攻击者)本来就能得手——资源碾压才是根本困境。
作者观察到各公司领导层正纷纷防御「最近高危事件对应的 swarm 场景」,他认为更该担心的是有人用 27B 本地模型攻击你自建的公网 Web 应用,而非前一种场景。
「漫话AGI」频道最新
- willdepue 再谈 AI 未来:别执着于现有能力,它们会消失 — willdepue · 2026-09-23
- OpenAI 研究员:未来人类工作将全成「手工艺术品」 — willdepue · 2026-09-23
- 「随机鹦鹉」论战再起:LLM 前沿数学已超人类,监督机制成关键议题 — ctjlewis · 2026-09-23
- AI 圈观点:最好的创始人都是「邪教领袖」 — ai · 2026-09-23
- 「列表体」成 AI 写作最明显破绽:看似周全实则自由联想 — sethlazar · 2026-09-23
- 评论:大厂借「安全」之名压制竞争,AI 监管惠及巨头 — DavidLinthicum · 2026-09-23