DepthFirst 发布 dfbench,评测大模型防御性安全能力

andreamichi · x · 2026-08-20

安全团队 DepthFirst 推出了 dfbench,这是一个用于评估前沿模型和智能体系统的防御性网络安全基准。该基准专注于检测、验证和差异分析三个目标,衡量智能体是否能在可持续成本下提供可操作的安全覆盖,并包含 GPT、Gemini 等模型在 Recall 和 Precision 上的图表对比。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →