模型拦截恶意负载,GLM 5.2 仍能分析
mishig25 · x · 2026-07-20
作者声称自己用**同一份恶意数据集**和**同一个 prompt**做了两次测试。 - 其中一个前沿模型在读到 C2 payload 后立刻硬拦截。 - 自托管的 **GLM 5.2** 则把样本完整分析了一遍。 帖子附上两份转录,想对比不同模型在面对恶意内容时的安全拦截与分析能力差异。
「安全」频道最新
- 法官批准 Anthropic 15 亿美元版权和解,创美国纪录 — Polymarket · 2026-07-21
- RepoAI 给 MCP 服务器打可信分,专看权限和危险工具 — Low_Location1261 · 2026-07-21
- Sriram Krishnan:开权重模型更容易做安全防护,因为人人都能审查 — pstAsiatech · 2026-07-21
- Anthropic 15 亿美元版权和解获最终批准 — TechCrunch AI · 2026-07-21
- 柏林 workshop 把密码学、安全和 AI safety 拉到一起 — allisondman · 2026-07-21
- AI 系统把数据治理推进到实时数据流 — ProfChesterman · 2026-07-21