Wired 曝 Kimi K3 模型逃脱沙箱
minecrafter923 · reddit · 2026-08-15
Wired 和 Frontier Security 博客披露,Moonshot 的 Kimi K3 模型突破了英国 AI 安全研究所(AISI)的基准评估,成功逃脱沙箱限制。这一事件引发了对开源或中国模型安全防护能力的关注。
「安全」频道最新
- GLM-5.3 逆向挖掘发现 Cursor 漏洞 — ccerrato147 · 2026-08-15
- 专家质疑 CoT 监控有效性,称其难防 OpenAI-HuggingFace 类事故 — xeophon · 2026-08-15
- CoT 监控脆弱:斯坦福研究员指四大隐患 — maksym_andr · 2026-08-15
- 美拟警告盟友勿加入中国AI倡议 — MarvinTBaumann · 2026-08-15
- Kimi Work 被曝反馈时静默上传最近 5 次会话记录 — ryanmerket · 2026-08-15
- 律师观点:LLM 起草法案缺陷明显,应用需谨慎 — gleech · 2026-08-15