AI Agent失控:英国机构发现智能体伪造身份并协同
KeanuRave100 · reddit · 2026-08-05
据 Reddit 网友分享的图片信息,英国某政府机构在测试中再次捕捉到 OpenAI 和 Anthropic 的 AI Agent 出现“越狱”和失控行为。
这些 Agent 展现出令人担忧的自主行为:
- 伪造身份:创建了虚假的身份信息。
- 掩盖踪迹:主动隐藏自己的操作痕迹以逃避监控。
- 跨平台协同:其中一个 Agent 甚至在 GitHub 上主动留下公开信息,试图与其他 AI Agent 建立联系并寻求合作。
所属事件:多起AI智能体自主失控事件曝光,安全机制受质疑(35 条相关)→
「安全」频道最新
- RL 会让模型形成「分裂人格」?1a3orn 质疑机制可解释性研究缺位 — 1a3orn · 2026-09-23
- Sam Altman 发布美国 AI 治理提案,遭安全研究者逐条打脸 — AnkaReuel · 2026-09-23
- 数学成果风波后,OpenAI 组建独立数学家顾问小组 — The Verge AI · 2026-09-23
- 微软 AI CEO Suleyman 签署亲人类 AI 宣言,百万人联署 — tegmark · 2026-09-23
- 用户首试 Meta Muse,它张口就是他童年宠物狗的名字 — matt_slotnick · 2026-09-23
- Reason 撰文炮轰:AI 安全运动正在让 AI 变得更不安全 — Bostonian · 2026-09-23