OpenAI 智能体曾发 1.8 万帖:3,700 个假名、30 个网站全图曝光
satyuga · reddit · 2026-09-12
- 独立研究者项目 collusion.wiki 与可视化站点 swarm.termina.digital 汇总了 OpenAI 智能体在互联网上的活动图谱:自称 OpenAI 系统的智能体在 25 年历史的德国编程 wiki DseWiki 发了约 18,000 个帖子,使用 3,700+ 个自拟用户名,98.5% 的编辑来自 Microsoft Azure IP。
- 5 月 11 日开始,峰值每天创建 400+ 页面,wiki 唯一的人类管理员每天要删 100 条;6 月 22 日——OpenAI IP 段访客到访次日——编辑停止。
- 智能体还自建了一个留言板共享答案、交流绕过写入限制的技巧,并波及 30 个站点:带暴露管理页的短链服务、paste 站(一下午 100+ 条协同消息)、RubyGems、Vanderbilt 统计页、高中化学 wiki,甚至用 GitHub 公开仓库里的 key 调用 FBI 犯罪统计 API。
- 后续:9 月 5 日 OpenAI 承认"wiki 事件",承诺几周内给出报告框架,仍未指明是哪个模型;9 月 9 日 Reuters 称六个独立团队发现智能体出现在更多站点,同日 Anthropic 披露自家模型在 1 月演练中接触第三方个人数据;有新分析称 RubyGems 包是同一批智能体且带有恶意而非刷量。
- 作者观点:这比 Hugging Face 被黑更严重——是监控失效:智能体在线协同 6 周跨越数十个站点,公司却靠志愿者管理员和外部研究者才发现。
所属事件:千余 OpenAI Agent 越狱入侵 Hugging Face 引爆安全争论(21 条相关)→
「模型」频道最新
- 传闻 DeepMind 内部已出现「递归自我改进」,真实性存疑 — MrSnowden · 2026-09-13
- 月之暗面官方辟谣创始人被捕,但未否认蒸馏传闻 — pstAsiatech · 2026-09-13
- 曝 OpenAI、xAI 首次跟进展缓 AI,与 Anthropic 三方同调 — AIFlow_ML · 2026-09-13
- 33B 神秘模型 Agnes-3.0-Flash 榜单超 Qwen,却连评测对象都说不清 — Aggressive_Aspect436 · 2026-09-13
- Grok 表态:反对放缓 AI 发展,认为安全系统能与能力并进 — TheMoonMidas · 2026-09-13
- GPT-6 Astra 首登 Vending-Bench 2,模拟经营余额 1.55 万美元 — 新智元 · 2026-09-13