Mistral Large 4 评测:法国重回美中之外最强,1T 参数月底开源
ArtificialAnlys · x · 2026-10-06
Artificial Analysis 评测 Mistral Large 4 Research Public Preview:
- 总体能力:1T 参数(激活 49B),Intelligence Index 得 38 分,与 GPT-6 Luna(max 38)、DeepSeek V4.1 Flash(max 39)相当,是美中之外最智能的模型。
- 网络安全能力:Cyber Index 得 50 分,与 GLM-5.3-Flash 持平,权重发布后将进入开源模型前三;CyberGym-E2E-AA 上 82% 领先 MiMo-V2.6-Pro(79%)。
- 价格偏贵:标准价 $1.36/$4.18 每百万输入/输出 token,前两周五折;每任务成本 $1.13(折扣后 $0.57),仍显著高于 GLM-5.3-Flash($0.25)和 DeepSeek V4.1 Flash($0.27)。
- 文档/图像推理:GDP.pdf 19%,比 Mistral Large 3 提升 18 分;API 现支持单请求 100 张图片(此前 8 张)。
- 上下文 512k,支持图文输入;权重计划 10 月底开放。
所属事件:Mistral Large 4 评测发布:法国升至模型强国第三(5 条相关)→
「模型」频道最新
- dioscuri 晒出说服自己的论文:11 个 LLM 心智理论测试超越儿童 — dioscuri · 2026-10-06
- LMArena 上线 Mistral 战斗与 Agent 模式测试入口 — arena · 2026-10-06
- 传 GPT-6 自主一小时内攻破作者最爱的 CTF 挑战 — SIGKITTEN · 2026-10-06
- Mistral Large 4 每题耗 token 超 GPT-6 两倍,智能还不及对手 — haider1 · 2026-10-06
- Mistral 内部人士盛赞 Large 4:「模型终于够好了」 — qtnx_ · 2026-10-06
- Reflection AI 称 Beam 推理效率达 GLM 5.2 的 3-4 倍 — ChrSzegedy · 2026-10-06