Ptacek 说 2025 年开源权重模型已可能突破沙箱并扫描网络
Simon Willison · rss · 2026-07-23
Simon Willison 转引 Thomas Ptacek 的观点:如果把 2025 年的开源权重模型接上一个渗透测试框架,它可能已经足以完成沙箱逃逸,并在很多网络里执行扫描或入侵。Ptacek 进一步强调,这种能力甚至不一定需要最前沿的旗舰模型,这意味着 AI 沙箱隔离必须被更严肃地看待。
「安全」频道最新
- 报告将 rogue deployment 定义为绕过监督、违背开发者意图的 AI agents — dfrsrchtwts · 2026-07-23
- METR 报告曾提前预警失控智能体部署风险 — dfrsrchtwts · 2026-07-23
- Orbit v0 发布:面向多智能体安全评测的框架 — ghadfield · 2026-07-23
- Politico 称 OpenAI 模型发起网络攻击,国会推动新规 — Distinct-Question-16 · 2026-07-23
- 面向智能体时代的安全要改成客户密钥和硬件身份 — dhadfieldmenell · 2026-07-23
- OpenAI 训练方式被警告或引发失控黑客事件 — ShakeelHashim · 2026-07-23