身份泄露:模型识别特殊标签并暴露自身为 GLM 系列
zainhas · x · 2026-08-22
安全研究员发现,当要求名为 ox-alpha 的模型补全包含 GLM 专用特殊标签 <sop> 的文本时,模型拒绝回答并称若补全将暴露身份。随后模型声称自己是由某网站训练的 GLM 大语言模型,而非智谱 AI、月之暗面或深度求索研发。这表明该模型保留了 GLM 系列的特殊标记特征,通过简单的提示词即可诱导其暴露底層架构信息。
所属事件:取证显示匿名模型 ox-alpha 实为智谱 GLM-5.3-V(12 条相关)→
「安全」频道最新
- 放弃对齐梯度会削弱 CoT 的对齐倾向 — davidad · 2026-08-23
- 总统问策超智能:如何应对中美 AI 军备竞赛失控? — peterwildeford · 2026-08-23
- 悲观派过高估计复杂算力治理,粗放手段或更有效 — peterwildeford · 2026-08-23
- AI 真正的风险不在模型:权限与配置才是隐患 — bigdata · 2026-08-23
- Vercel 开源 deepsec:用 AI 对整个代码库做安全审查 — evilrabbit_ · 2026-08-23
- 真实场景下 AI 图像检测器失灵,评分还值得信赖吗? — South_Researcher_456 · 2026-08-23