Cribl 发布 SecIT Bench,模型诊断成本差 20 倍

Cribl 发布 SecIT Bench,一个评估 AI 智能体在真实 IT 与安全(SOC/SRE)工作流中表现的遥测基准。测试让 14 个前沿模型处理 30 个真实事故场景,结果显示尽管各模型诊断准确度相近,调查成本却相差高达 20 倍,凸显选择模型时成本因素的重要性。

2026-08-20 ~ 2026-08-20 · 2 条相关