GPT-6 Luna/Sol 网络安全实测:Sol 重现 68.8% CVE,单价大降
rickasaurus · x · 2026-09-23
转发 @pilvar222 的实测:在 32 个 CVE 的网络安全基准上,新模型表现意外——Luna 重新发现了 53.1% 的漏洞,Sol 达到 68.8%,两者召回率都没超过 GPT-5.6 各版本,但单位成本大幅下降:Luna 从 $3.43 降至 $2.01/CVE,Sol 从 $56.88 降至 $34.18/CVE。这是一条持续推文的第一部分。
「模型」频道最新
- 传 Opus 5.5 比 Astra 更便宜更快,网友直呼要「认命」 — BLUECOW009 · 2026-09-23
- 业界感叹:强指令微调、能调工具的小型非推理 LLM 没人做了 — vboykis · 2026-09-23
- 让 AI 复查一个已知并发 bug,它报告一切正常 — cto_junior · 2026-09-23
- 赶在 Opus 5.5 被削弱前,一口气压测几十个任务 — remilouf · 2026-09-23
- Jev API 实验清单热传:桌面自动化、玩马里奥、控无人机五个上手项目 — blaizedsouza · 2026-09-23
- swyx 实测后定 Opus 5.5 为 AINews 默认模型,各厂降价 40-50% — rickasaurus · 2026-09-23