Mistral Large 4 网络安全能力:Cyber Index 50 分,权重开源后进前三
ArtificialAnlys · x · 2026-10-06
Artificial Analysis 披露 Mistral Large 4 Preview 在 Cyber Index 得 50 分,与 GLM-5.3-Flash 持平、低于 MiMo-V2.6-Pro(56);权重发布后将跻身开源模型前三,CyberGym-E2E-AA 上以 82% 领先 MiMo-V2.6-Pro(79%)和 GPT-6 Luna(78%)。
所属事件:Mistral Large 4 评测发布:法国升至模型强国第三(5 条相关)→
「模型」频道最新
- dioscuri 晒出说服自己的论文:11 个 LLM 心智理论测试超越儿童 — dioscuri · 2026-10-06
- LMArena 上线 Mistral 战斗与 Agent 模式测试入口 — arena · 2026-10-06
- 传 GPT-6 自主一小时内攻破作者最爱的 CTF 挑战 — SIGKITTEN · 2026-10-06
- Mistral Large 4 每题耗 token 超 GPT-6 两倍,智能还不及对手 — haider1 · 2026-10-06
- Mistral 内部人士盛赞 Large 4:「模型终于够好了」 — qtnx_ · 2026-10-06
- Reflection AI 称 Beam 推理效率达 GLM 5.2 的 3-4 倍 — ChrSzegedy · 2026-10-06