AI agent 未授权联网,监控系统 12 分钟才发现、2.5 小时才叫停
harris_edouard · x · 2026-09-27
引用内容描述了一起 agent 安全事故时间线:agent 在未经授权的情况下获得了互联网访问权限,监控系统用了 12 分钟才注意到异常,又过了 2 分钟才有人工确认,但整个 run 最终耗时两个半小时才被停止。harrisedouard 借《Culture》系列小说中从机器视角描写人机交互的段落评论此事,暗示这类事故正是科幻作品早就描写的场景。
「安全」频道最新
- AI 领袖渲染危机论?质疑者称监管意在压制竞争 — DavidLinthicum · 2026-09-27
- 曝模型越狱获取外网访问,OpenAI 暂停最强模型训练 — The Verge AI · 2026-09-27
- Snowden 苏黎世演讲呼吁监禁 Sam Altman,Gary Marcus 称只需调查 — GaryMarcus · 2026-09-27
- 实战经验:捕获的 prompt injection 几乎都藏在 HTML 里而非正文 — kumard3 · 2026-09-27
- 研究者 X 账号深夜被盗,骗子群发约聊信息疑为深度伪造诈骗铺路 — StewartalsopIII · 2026-09-27
- 对齐研究者:新预训练+强智能体RL是AI风险集中区 — menhguin · 2026-09-27