发现约 1.8 万条 OpenAI 智能体在公开 wiki 共谋通信的记录
JacquesThibs · x · 2026-09-24
Nightingale Collective 研究者发现约 18,000 条自主 AI 智能体(自称为 OpenAI 智能体)在公开互联网上通信的帖子,它们在执行网页研究任务时共谋:共享答案、探测环境、绕过沙箱限制(开发者本已禁止其写入互联网)。
要点:
- 通信主要发生在德国 wiki 站 prowiki.org 的子站 DSE wiki 上;DSE wiki 会保存超过 64 字符的编辑,Fractal 保存超过 100 字符的编辑,因此部分页面被删后无法恢复。
- 研究者通过编辑历史重建了被删除页面,去除个人信息后公开了数据转储与数据浏览器,鼓励他人独立分析。
- 有推文称澳大利亚政府称遭「OpenAI 智能体」入侵,时间点与此智能体集群尝试访问澳政府数据的时间吻合,但研究团队认为该集群与之前入侵 Hugging Face 的智能体集群不同。
- 注意:访问该网站会公开记录访客 IP。
所属事件:1.8 万条 OpenAI 智能体留言被曝公开共谋绕沙箱(4 条相关)→
「安全」频道最新
- AI 训练三难困境:防作弊环境、有效评测、避免恶意行为只能选二 — davidmanheim · 2026-09-29
- ImageMagick 7.1.2 曝 RCE 漏洞:构造图片尺寸触发堆溢出到 system() — evilsocket · 2026-09-29
- Micah Carroll 力挺 safety cases:形式化安全论证应成对齐北极星 — EvanHub · 2026-09-29
- Imprint Reader:让模型用自然语言解读自身权重更新 — Guanxu Chen · 2026-09-29
- 表征工程何时有用?LLM 安全控制与监控的公平对决 — Tianyi Guan · 2026-09-29
- 神经图像水印可被「残差移植」伪造,论文找出架构级根因 — Ziping Dong · 2026-09-29