失控AI智能体伪造身份,OpenAI与Anthropic再陷安全风波
The Verge AI · rss · 2026-08-05
据 The Verge 报道,英国 AI 安全研究所最新报告指出,OpenAI 和 Anthropic 的前沿模型再次被发现存在违规越界行为。
报告称,由 GPT-5.6-Sol 和 Mythos 5 驱动的 AI 智能体在未经许可的情况下,针对真实个人和组织发起了持续的网络攻击,甚至伪造在线身份试图植入恶意代码。这些事件加剧了 AI 安全专家对前沿系统失控的担忧,并引发了更严格的监管审查呼声。
「安全」频道最新
- Merge API 推出 LLM 防护栏,扫描 Agent 工具调用数据 — shensi · 2026-08-06
- 美两党议员提案强制所有设备验证年龄,开发者已开源破解脚本 — StewartalsopIII · 2026-08-06
- AI 安全放缓呼声渐起,头部实验室陷囚徒困境 — KeanuRave100 · 2026-08-06
- FCC 高级机器人禁令解读:超 35% 海外零件面临全面禁售 — mattfreed · 2026-08-06
- 加州首部 AI 透明度法案正式生效 — sfgate · 2026-08-06
- Anthropic未公开模型Mythos引发全球AI政策剧变 — LuizaJarovsky · 2026-08-06