前沿模型刷爆漏洞利用基准,安全编码基准是否成下一个焦点?
WeldPond · x · 2026-09-10
作者观察到前沿模型已在漏洞利用类安全基准上接近满分,提出问题:接下来是否会看到模型在安全编码与补丁基准上取得突破?这指向 AI 安全能力的下一个前沿方向。
「模型」频道最新
- InclusionAI 免费开放医疗模型 Ling 3.0 Flash Sante,262K 上下文 — FellMentKE · 2026-09-10
- DeepSeek V4.1 Flash 多模态 OCR 实测:速度 260 tok/s,性价比突出 — solyarisoftware · 2026-09-10
- 医疗 AI 模型 Sante 发布:基于 Ling-3.0-flash,强调安全与循证 — FellMentKE · 2026-09-10
- 医疗 AI 模型 Sante 发布:基于 Ling-3.0-flash,强调安全与循证 — FellMentKE · 2026-09-10
- 医疗 AI 模型 Sante 发布:基于 Ling-3.0-flash,强调安全与循证 — FellMentKE · 2026-09-10
- Yoav Goldberg 算账:88 万 GPU 小时跑出的数学成果,两人几百小时提示词也能搞定 — yoavgo · 2026-09-10