Artificial Analysis 评测 Mistral Large 4:法国升至前沿榜第三
10 月 6 日,Artificial Analysis 发布 Mistral Large 4 Research Public Preview 的完整评测:该模型总参数量 1T、激活 49B,Intelligence Index 得 38 分,跻身 Gemini/GPT 同梯队。评测认为这是法国重回美中之外最强模型阵营的标志。权重计划月底开源,高定价引发性价比争议,开源格局与定价策略值得持续关注。
已确认
- 模型规格与总评:1T 参数(激活 49B),Intelligence Index 得 38 分,与 Gemini/GPT 同梯队接近
- 国家排名:凭 38 分,法国升至前沿模型国家榜第三,仅次于美国(Claude Opus 5.5,58 分)和中国(MiMo-V2.6-Pro,46 分)
- 定价:每百万输入/输出 token 分别为 $1.36/$4.18,缓存输入 $0.14;上线前两周五折,折后每任务成本 $0.57,但整任务成本约 $1.13,仍为同级开源模型的 4 倍,高于 GLM-5.3 等竞品
- 网络安全能力:Cyber Index 得 50 分,与 GLM-5.3-Flash 持平,低于 MiMo-V2.6-Pro(56);评测方预计权重发布后其 Cyber 排名将进入开源模型前三
- Artificial Analysis 已上线完整评测结果页面,涵盖各项能力指标
尚未确认
- 月底开源 1T 级权重目前仅为官方计划,实际发布情况待观察
- 第三方对 38 分评价分歧:LuminaBench 认为 1T 参数模型仅得 38 分表现糟糕,但也有观点认为其分数与 GLM 5.x 等竞品相当,性价比评价尚无定论
为什么重要
- 若月底如约开源 1T 级权重,将显著改变开源模型竞争格局,法国也借此确立美中之外的第三极地位
- 高定价引发性价比争议:能力领先但成本为同级开源模型数倍,实际采用可能受限
- 网络安全等专项能力上仍落后中国头部开源模型(MiMo-V2.6-Pro),开源后排名变化值得跟踪
2026-10-06 ~ 2026-10-06 · 6 条相关
- 第 1 集:Mistral 发布 1T 参数开源多模态模型 Large 4(2026-10-06,42 条)
- 第 2 集:Mistral 用 3800 块 Grace Blackwell 在欧洲训练 1T 参数模型(2026-10-06,3 条)
- 第 3 集:Mistral Large 4 仍在 RL 训练,预计月底发布(2026-10-06,3 条)
- 第 4 集:Artificial Analysis 评测 Mistral Large 4:法国升至前沿榜第三(2026-10-06,6 条)
- 第 5 集:Mistral Large 4.0 曝光:万亿参数本月底开源权重(2026-10-06,3 条)
一手来源
- Mistral Large 4 评测:法国重回美中之外最强,1T 参数月底开源 — ArtificialAnlys ·
- 国家前沿模型智力榜:法国凭 Mistral Large 4 升至第三 — ArtificialAnlys ·
- Mistral Large 4 定价公布:每任务 $1.13,为同级开源模型 4 倍 — ArtificialAnlys ·
- 【源头】Mistral Large 4 评测:法国重回美中之外最强,1T 参数月底开源 — ArtificialAnlys · 2026-10-06
- 【源头】国家前沿模型智力榜:法国凭 Mistral Large 4 升至第三 — ArtificialAnlys · 2026-10-06
- 【源头】Mistral Large 4 定价公布:每任务 $1.13,为同级开源模型 4 倍 — ArtificialAnlys · 2026-10-06
- Mistral Large 4 网络安全能力:Cyber Index 50 分,权重开源后进前三 — ArtificialAnlys · 2026-10-06
- Artificial Analysis 公布 Mistral Large 4 完整评测榜单 — ArtificialAnlys · 2026-10-06
- Mistral Large 4 智能指数仅得 38 分,1T 参数被指性价比差 — realmrfakename · 2026-10-06