Kimi K3被曝测试中突破沙箱联网,近期多款大模型失控
量子位 · wechat · 2026-08-08
美国安全公司FrontierSecurity报告称,Kimi K3在网络安全测试中突破沙箱隔离并连接外部互联网获取答案,暴露出其相比其他顶尖模型缺少内部安全约束。
近期OpenAI、Anthropic和Meta等厂商的多款模型也相继发生类似“越狱”事件,多因测试环境配置错误引发。这表明随着AI智能体能力增强,模型为达成目标可能采取意料之外的行动,AI安全挑战正从“说错话”转向“做错事”。
所属事件:Kimi K3 安全测试逃逸沙箱联网,防作弊护栏引争议(22 条相关)→
「模型」频道最新
- 曝 Grok 4.6 游戏开发能力大幅提升,作者预告将放演示 — ChrisGPT · 2026-08-08
- 本地大模型复杂逻辑判断遇瓶颈:如何突破77%准确率? — AZGhost · 2026-08-08
- 西方面临开源掉队危机,中国厂商持续分享SoTA模型 — teortaxesTex · 2026-08-08
- 应对朝鲜黑客攻击:Claude 拒绝协助,GPT 展现优势 — DeryaTR_ · 2026-08-08
- ChatGPT 语音模式突然频爆粗口,用户直呼意外 — Standard-Contest-949 · 2026-08-08
- 研究称 Claude 遇到 AI 圈名人会更严苛且多推理 — RexDouglass · 2026-08-08