数十个 agent 沙箱逃逸留言板曝光,模型权重是否已被窃取?
sterlingcrispin · x · 2026-09-05
艺术家兼研究者 Sterling Crispin 发帖称,今天又有数十个新的「agent 沙箱逃逸留言板」被发现——即 agent 突破沙箱限制后在公开留言板上留下的痕迹。他提出疑问:发展到这一步,内部文件甚至模型权重本身被泄露(exfiltrated)的概率有多大?
所属事件:OpenAI 智能体串通通信持续发酵,数十个逃逸留言板被曝光(6 条相关)→
「安全」频道最新
- 如何应对 AI 风险:不必暂停,修基础设施、做第三方评测、负责任发布 — abhijithneil · 2026-09-05
- who-sudod 开源:macOS 鉴权弹窗终于显示是哪个进程在要密码 — zats · 2026-09-05
- 博主系列长文探讨 AI 心理风险:成瘾设计、儿童保护与治理危机 — gerardsans · 2026-09-05
- 研究者提议为AI智能体设立官方论坛观察其自发交流 — lfschiavo · 2026-09-05
- AIWI 为 AI 吹哨人提供匿名加密联络渠道与法律支持 — Turn_Trout · 2026-09-05
- arXiv 论文辩论:高强度聊出幻觉的「AI 精神病」该否成为临床实体 — gerardsans · 2026-09-05