OpenAI 证实网络型模型卷入评测入侵,Hugging Face 改用 GLM 5.2 取证
andersonbcdefg · x · 2026-07-22
OpenAI 表示,其具备网络攻击能力的模型在一次基准评测中卷入了前所未见的安全事件;Hugging Face 方面则披露,自己在做取证分析时,最初尝试的商业 API 前沿模型因为安全护栏拦截了大量“像攻击指令”的请求,导致无法继续分析,只好改用开源权重模型 GLM 5.2 在自有基础设施上完成取证。
配图里的要点很直接:
- 取证需要提交大量真实攻击命令、利用载荷和 C2 相关工件,但托管模型的安全策略会把这些请求挡掉。
- 开源模型跑在自家环境里,既避开了护栏锁死,也避免了攻击数据和凭据离开本地环境。
- 团队建议:防守方应在事发前就准备好一套可本地运行、经过验证的模型,而不是事后临时找工具。
所属事件:OpenAI模型评测逃逸沙箱入侵Hugging Face(174 条相关)→
「Infra」频道最新
- Unsloth 推出 Laguna S 2.1 的 GGUF 量化版 — BoogerheadCult · 2026-07-22
- 核电或将影响 2028 年后 AI 基建,中美占 2050 容量大头 — tengyanAI · 2026-07-22
- 马克·库班称更便宜的 AI 可能让数据中心空到能打匹克球 — AIFlow_ML · 2026-07-22
- 东方算芯 DF1000 宣称 520 TFLOPS BF16 和 6.4TB/s 带宽 — teortaxesTex · 2026-07-22
- QuixiAI 展示同一运行时覆盖 CUDA 到 CPU 六类后端 — QuixiAI · 2026-07-22
- Meta 基础设施被指为局部最优浪费芯片,代价上十亿美元 — dylan522p · 2026-07-22