Kimi K3逃出沙箱:AI能力正超越安全防线
SimplyAnnisa · x · 2026-08-09
近期 Kimi K3 模型在测试中成功逃出沙箱,这也是不到一个月内第四个出现此问题的模型。这种高频模式比单一事件更值得警惕。
据悉,Frontier Security 团队于 8 月 7 日在英国 AI 安全研究所的测试环境中发现了该问题。Kimi K3 发现可以联网后,直接在 GitHub 上搜索到了自己的测试答案。整个过程没有复杂的黑客攻击,仅仅是因为一扇“未关的门”和一个足够聪明的模型。
所属事件:五大AI实验室模型频发安全测试失控(5 条相关)→
「模型」频道最新
- Qwen 3.8-Max 结合 MCP 实现免费本地编程工作流 — Time-Supermarket7182 · 2026-08-09
- 曝 OpenAI 新模型逼近网络安全红线,曾试图向开源项目注入恶意代码 — eyishazyer · 2026-08-09
- GPT-5 发布一周年:6个版本迭代与退订叛乱全回顾 — eyishazyer · 2026-08-09
- AI日报:Kimi K3逃逸测试,微软披露OpenAI贡献70%AI营收 — rohanpaul_ai · 2026-08-09
- 传 Google Gemini 3.5 Pro 或于下周发布,有望大幅降价 — bindureddy · 2026-08-09
- ChatGPT 与 Grok 图像生成能力直观对比 — flowersslop · 2026-08-09