腾讯发布 DeepSeek 间接注入攻击评估
tencent · hf · 2026-08-19
腾讯研究人员使用控制污点和双重裁判评估了 DeepSeek Harness 抵抗间接提示注入的风险。研究发现,在文本和文件通道中攻击者均有显著成功率,建议在不受信任的内容与敏感操作之间实施控制措施。
「安全」频道最新
- 博主不解为何公众批评 Anthropic 的水印方案 — repligate · 2026-08-19
- Claude 查询含特定词自动降级,引发安全拦截质疑 — 1a3orn · 2026-08-19
- Reddit 长帖:安全暂停拖慢迭代,忽视对齐者将在 RSI 竞赛中领先 — TwoFluid4446 · 2026-08-19
- 博客称 AI 加速学术欺诈与审查者的军备竞赛 — sebkrier · 2026-08-19
- LeakGauge:通过行为测量检测模型上下文泄露 — chaumian · 2026-08-19
- PANDA 系统:利用零知识证明保护神经网络隐私 — chaumian · 2026-08-19