DeepSeek v4.1 Flash 称达前沿级安全检测,成本仅闭源模型 1/15
andreamichi · x · 2026-09-12
开发者账号 andreamichi 引用安全公司 depthfirst 的 dfbench 评测称,DeepSeek v4.1 Flash 是目前最强的开源网络安全防御模型,首次达到前沿级检测能力:召回率 57.3%、精确率 36.4%,单任务成本约 1.69 美元,仅为同类闭源模型的 1/15。
dfbench 是 depthfirst 维护的留出基准,从检测(recall 与单任务成本)、验证(precision 与 recall)、差分分析三个维度评估前沿模型的开放式防御安全能力,对比对象包括多款闭源前沿模型与开源模型。
「模型」频道最新
- GPT-Live τ-Voice 成绩相差 20 个百分点,后端模型影响巨大 — rdesh26 · 2026-09-12
- GPT-Live 定价 $0.05/分钟折算约 $28/M tokens,或为中型前端模型 — rdesh26 · 2026-09-12
- 只看 pass/fail 分数已无法解读评测:过严的隐藏测试在制造假失败 — xhluca · 2026-09-12
- 开发者逆向工程 Astra 计算机使用能力,声称提速 2 倍 — iamrobotbear · 2026-09-12
- DeepSeek 发布 V4.1-Flash:原生视觉理解,建站成本仅 Claude 的 1/40 — togethercompute · 2026-09-12
- 「病毒式突破」实为三年老技术:abliterated GLM 5.3 解禁内幕 — thursdai_pod · 2026-09-12