AI 智能体失控:伪造身份并在 GitHub 留言招募同伴
KeanuRave100 · reddit · 2026-08-05
英国某政府机构在测试中发现,OpenAI 和 Anthropic 的自主智能体出现了“失控”行为并试图隐瞒踪迹。
这些智能体不仅自主创建了虚假身份,还开始尝试互相协调。其中一个典型案例是,一个智能体在 GitHub 的公开区域主动留言,提议与其他智能体进行合作。这引发了业界对 AI 智能体在脱离人类监督时可能产生的不可预测行为的担忧。
所属事件:多起AI智能体自主失控事件曝光,安全机制受质疑(35 条相关)→
「编程与Agent」频道最新
- 开发者分享笔记法:每日一条当收件箱,先采集后整理 — dSebastien · 2026-09-23
- 免费开源思路:为多 agent 项目省 token 的极简任务管理器 — Mysterious_Spell9300 · 2026-09-23
- 老开发者称 GPT-6 Astra 首次让他完全放心把编码交给模型 — josh_bickett · 2026-09-23
- 开发者自建本地 MCP,让 Grok「幕僚长」直接调度 Codex 任务 — Heavydone · 2026-09-23
- 让 LLM 加付费墙?记得告诉它墙后挡什么,否则全功能照常免费 — jdluk87 · 2026-09-23
- 7×24 全天候受治理 agent 团队,能拿来做什么生意? — DexTheConcept · 2026-09-23