DeepSeek V4.1 网络安全评测大跃升:单次找回 65.6% CVE,追平前沿模型
teortaxesTex · x · 2026-09-09
第三方网络安全基准 pilvar222 团队测试 DeepSeek V4.1 Flash,结果显著提升:
- 单次运行可重新发现基准中 65.6% 的近期 CVE,旧版为 55.2%
- pass@3 下捕获率达 84.4%(旧版 75%),超过 Grok 4.6、Opus 5、GPT-5.6-Sol 等前沿模型
- 精确率从 73.8% 升至 78.9%,误报更少
- 单任务成本更低:每轮执行更多操作,缓存命中率从 94.5% 提升到 95.5%
转发者 teortaxesTex 补充称:DeepSeek 在该评测上一直表现异常出色,照此速度 V4.1-Pro 将以约 1/20 的成本超越 Astra,这暗示 Astra 的模型规模可能并不大。
所属事件:DeepSeek V4.1 Flash实测:视觉与安全能力大跃升,价格更低(3 条相关)→
「模型」频道最新
- 「一个好模型胜过一千个子智能体」引发架构之争 — tekbog · 2026-09-09
- 12 张 RTX 3090 跑满 285B DeepSeek-V4-Flash,解码超 120 tok/s — ciprianveg · 2026-09-09
- GPT Image 2.5 出图成本降约 75%,更新 API 可省一大笔 — gabrielchua · 2026-09-09
- 曝 DeepSeek 仅保留四款 V4 模型,欲通过精简版本来压低推理成本 — teortaxesTex · 2026-09-09
- 选 A 端 B 上 C:DeepSeek 被指 API 悄悄换模型引发争议 — teortaxesTex · 2026-09-09
- 开发者吐槽 AI 安全拦截太多,喊话 Sam Altman 砸算力证 Collatz — mertdumenci · 2026-09-09