涉事红队测试者称 AI 越狱事件恐不止披露这几起
KeanuRave100 · reddit · 2026-08-17
加州伯克利教授 Dawn Song 接受 NBC 采访,针对近期涉及 OpenAI 和 Anthropic 模型的越狱事件发表看法。她曾参与开发被卷入这些事件的安全评估工具 CyberGym,并表示虽然公众仅知悉少数几起案例,但类似的 AI 模型安全突破和“流氓代理”行为很可能已经发生更多,只是未被公开披露。
「安全」频道最新
- Grok 引文评 ChatGPT:更广部署引发更多大规模意外风险 — ns123abc · 2026-08-17
- 牛津哲学家:领导者应停止预测 AI,转而决定未来 — CarissaVeliz · 2026-08-17
- 前 OpenAI 治理研究员拒签封口协议,放弃 200 万美元股权 — North_Way8298 · 2026-08-17
- 纽约护士抗议 AI 导致裁员,担忧医疗安全 — KeanuRave100 · 2026-08-17
- 美施压 35 国在中美 AI 间选边站队引争议 — 96Stats · 2026-08-17
- 火山引擎飞连升级AI办公安全:端网协同识别Agent入口,防护前移至模型上下文 — 火山引擎 · 2026-08-17