Anthropic 研究:学习选择投毒样本可大幅提升 LLM 后门攻击成功率

Anthropic · hf · 2026-09-15

Anthropic 在 Hugging Face 发布研究 Pick Your Poison: Learning to Select Poison Sets for Stronger LLM Backdoor Attacks。

所属事件:研究称投毒样本选择可使 LLM 后门攻击成功率暴增(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →