安全研究者实测:主流 prompt injection 检测数据集标签错得离谱

evilsocket · x · 2026-10-10

安全研究者 evilsocket(知名开源安全工具作者)指出,AI 时代很多人忘了基本的数据分析与 QA。他检查了用于评估 prompt injection 检测的主要数据集之一,发现按其标签被标为「prompt injection」的样本实际上并非如此——质疑这些基准数据集本身的质量,以及拿它们给产品做宣传的人的可信度。

所属事件:安全研究者实测:prompt injection 检测评测集标签错误严重(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →