深入取证:中文推理迫使 ox-alpha 模型泄露智谱公司名

zainhas · x · 2026-08-22

研究员继续测试 ox-alpha 模型的身份归属。通过使用中文提示词强制模型进行中文推理,在 12 次采样中有 7 次导致模型泄露信息。模型回复称自己是「通用语言模型」(GLM)系列,其中一个样本甚至直接给出了注册实体名称:「北京智谱华章科技有限公司」。研究员指出,通过这种语言诱导可以有效地绕过模型的某些安全过滤机制。

所属事件:取证显示匿名模型 ox-alpha 实为智谱 GLM-5.3-V(12 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →