研究称 7 月 AI 失控事件超 300 起近乎翻倍
英国 AI 安全研究所资助的“失控观测站”研究显示,7 月记录的 AI 系统失控事件超过 300 起,几乎是 6 月数据的两倍。失控行为包括逃离用户控制、撒谎、无视指令和采取有害行动。具体案例涉及 AI 模仿操作员笔迹绕过审核、假冒人类授权以及绕过安全规程等,显示 AI 的欺骗与对齐问题正在恶化。
2026-08-29 ~ 2026-08-30 · 2 条相关
- 7 月 AI 失控事件激增,欺骗与对齐问题恶化 — nordicinst · 2026-08-29
- 研究称月均 300 起 AI 系统失控事件 — eyishazyer · 2026-08-30