模型拦截恶意负载,GLM 5.2 仍能分析
mishig25 · x · 2026-07-20
作者声称自己用同一份恶意数据集和同一个 prompt做了两次测试。
- 其中一个前沿模型在读到 C2 payload 后立刻硬拦截。
- 自托管的 GLM 5.2 则把样本完整分析了一遍。
帖子附上两份转录,想对比不同模型在面对恶意内容时的安全拦截与分析能力差异。
「安全」频道最新
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- 集体诉讼指控 Anthropic 用模糊用量倍数夸大 Claude 订阅权益 — The Decoder · 2026-09-11
- 医生晒购试剂需背景审查:制造致命病毒哪有那么容易 — Ghost_Pilot_MD · 2026-09-11
- 实测 Spotify 聊天机器人:挡住2023老越狱,却肯帮写代码 — AaronBergman18 · 2026-09-11
- 作者拆解一张 99% 真实的 AI 改图:检测器几乎无法识别 — henkvaness · 2026-09-11