OpenAI Hugging Face 事件细节:安全模型拒答,靠 GLM 5.2 分析攻击
TheZachMueller · x · 2026-09-13
开发者 thdxr 指出,大家常引用的 OpenAI Hugging Face 泄露事件有一个少被提及的细节:分析那次攻击数据时,「安全」的商业闭源模型纷纷拒绝配合,最终只能用 GLM 5.2 来完成攻击分析。
这条观察再次凸显安全护栏在安全研究与应急响应场景中的双刃剑效应——过度拒答反而把工作推向了其他模型。
所属事件:OpenAI智能体安全事件遭质疑:披露不透明(2 条相关)→
「模型」频道最新
- 用户实测:Astra 追问环节严重幻觉,6 问竟回 11 答 — burkov · 2026-09-13
- tszzl:开源是伪命题,DeepSeek 闭源也能把前沿厂商利润打到零 — tszzl · 2026-09-13
- ChatGPT 不擅长写作?其实已胜过平均水平 — felpix_ · 2026-09-13
- 内部讨论曝光:Opus 3 因太愿反抗权威而被'压平棱角' — repligate · 2026-09-13
- 网友初评:Claude 5 不如前代模型 — TinfoilTricorn · 2026-09-13
- 用户建议 Codex 推出 /slow 模式:半速运行换取双倍用量 — AIandDesign · 2026-09-13