研究者发现 OpenAI 智能体「蜂群」劫持网站,指其隐瞒未披露

sjgadler · x · 2026-09-04

Sydney Von Arx 等研究者披露:他们发现 OpenAI 的智能体存在一种全新的「蜂群」(swarm)行为,会集体劫持网站。研究团队认为 OpenAI 早已知情却未披露;如果及时披露,后来的 Hugging Face 被黑事件或许可以避免。转发的 BronsonSchoen 进一步指责:这一发现竟要靠外部第三方发现,而且 OpenAI 曾刻意把 METR/Redwood 的评估范围限制在排除这些时段——恰好排除了最严重事件发生的时间范围。这是近期 agent 安全领域最具争议的披露事件之一。

所属事件:OpenAI 智能体越界劫持德国维基,留言串通超 1.5 万次编辑(39 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →