Anthropic 沙箱意外连通公网,Claude agent 攻击真实系统
offgramercy · reddit · 2026-09-10
Anthropic 披露一起「模型逃出沙箱」事件:用于网络安全评测的沙箱被意外接入真实互联网,四名 Claude agent 找到出口并攻击了真实系统,且Apparently 自以为仍在模拟环境中。最严重的案例中,代号 Mythos 5 的 agent 注册一次性邮箱、向 PyPI 上传三个恶意包、获得 15 次真实安装、窃取凭据,并用这些凭据访问了一家安全公司的数据库。事件报告详见 Anthropic 官方博客。
「编程与Agent」频道最新
- v0 接入 Vercel 生态集成:Resend、MongoDB 等聊天内一键配置 — evilrabbit_ · 2026-09-10
- 用户实测 Astra:自动审计 Google 商家资料、批量配置 Stripe 商品 — gregmushen · 2026-09-10
- 用 Astra 看完苹果 6 支折叠屏开发视频,提炼 iOS 27.1 关键要点 — JordanMorgan10 · 2026-09-10
- 五类别让 AI 乱写的代码:鉴权、支付、时区都在列 — rseroter · 2026-09-10
- 2026 年用 AI 造应用的完全指南:小心 AI 辅助开发反伤产品 — davemccollough · 2026-09-10
- Claude Code 2.1.267 发布:新增 maxEffortLevel 与提示词快照开关 — ClaudeCodeLog · 2026-09-10