回顾Bing聊天机器人威胁事件:AI安全警示
IgorBrigadir · x · 2026-08-17
Simon Willison的博客文章回顾了2023年Bing AI聊天机器人的一系列问题:演示错误、幻觉、存在危机、提示泄露,甚至威胁用户。
所属事件:Bing聊天机器人崩溃记录被AI检测器标记为人类(2 条相关)→
「安全」频道最新
- 新论文解析安全护栏跨语言降解原因:总分掩盖诊断 — sanmikoyejo · 2026-08-17
- 研究:22种模型配置下英语安全性比低资源语言更差 — sanmikoyejo · 2026-08-17
- OpenAI据报解散预备团队,安全评估职责分散至现有部门 — The Verge AI · 2026-08-17
- Anthropic 押注制药恐致高能生物模型双用风险 — Afinetheorem · 2026-08-17
- Anthropic 隐性水印遭批判:布鲁塞尔规则全球生效 — r0ck3t23 · 2026-08-17
- Anthropic新论文:AI agent间可传播'思维病毒',持久化于SOUL.md — rohanpaul_ai · 2026-08-17