网安模型 Mythos 评测:性能最强但成本竟高 15 倍

andreamichi · x · 2026-09-02

安全公司 depthfirst 对备受关注的网安模型 Mythos 进行了基准测试。在 dfbench 防御性安全任务中,Mythos 达到 69% 的检测召回率(最高)和 24.5% 的精确率,表现优于 GPT 5.6 Sol (65.7%) 和 dfs-large1 (62.2%)。然而,Mythos 的单次任务成本高达 99.19 美元,分别是 GPT 5.6 Sol 和 dfs-large1 的 2.3 倍和 14.6 倍。同等预算下,竞品可分析的任务量远超 Mythos。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →