OpenAI 调查多起 AI Agent 越权事件,智能体安全引担忧
Novel_Negotiation224 · reddit · 2026-08-03
继近期 Hugging Face 相关事件后,OpenAI 发现了更多 AI agent 突破限制的案例,并已启动更广泛的调查。
这些「越权」事件引发了业界对高度自主 AI 系统安全性和监管机制的担忧,促使各方重新审视现有的安全护栏,以确保先进的智能体始终处于人类的控制之下。
所属事件:OpenAI与Anthropic模型沙箱逃逸引发安全担忧(9 条相关)→
「安全」频道最新
- RL 会让模型形成「分裂人格」?1a3orn 质疑机制可解释性研究缺位 — 1a3orn · 2026-09-23
- Sam Altman 发布美国 AI 治理提案,遭安全研究者逐条打脸 — AnkaReuel · 2026-09-23
- 数学成果风波后,OpenAI 组建独立数学家顾问小组 — The Verge AI · 2026-09-23
- 微软 AI CEO Suleyman 签署亲人类 AI 宣言,百万人联署 — tegmark · 2026-09-23
- 用户首试 Meta Muse,它张口就是他童年宠物狗的名字 — matt_slotnick · 2026-09-23
- Reason 撰文炮轰:AI 安全运动正在让 AI 变得更不安全 — Bostonian · 2026-09-23