专题 · FULL STORY
Mistral Large 4:从预告到公测的开源旗舰
路透社先行预告后,Mistral于10月6日官宣万亿参数旗舰模型Large 4(代号Le Chonk),开启Research Public Preview,强化学习训练仍在进行、开源权重预计月底放出。Artificial Analysis等评测称其助法国重回第三极,但性价比遭到质疑。
2026-10-06 ~ 2026-10-11 · 7 集 · 108 条
第 1 集 · Mistral 即将发布新旗舰,自称部分领域超越中国模型(2026-10-06,2 条)
据路透社报道,法国 AI 公司 Mistral 将于当日发布一款大型新旗舰模型。CEO Arthur Mensch 表示,该模型在某些方面超越中国模型,包括网络安全领域,并强调这是「欧洲」的成果。Reddit 用户引述该表态后,评论区普遍认为这一说法听起来过于夸张,对新模型的实际表现持观望态度。
- Mistral 新模型今日发布在即,Mensch 称部分领域超越中国模型 — uusrikas · 2026-10-06
- Mistral 将发布对标中国模型的新旗舰,自称网络领域能力占优 — testingcatalog · 2026-10-06
第 2 集 · Mistral 发布万亿参数开源旗舰 Large 4(2026-10-06,86 条)
Mistral 于 10 月 6 日官宣旗舰开放权重模型 Mistral Large 4(代号 Le Chonk)并开启 Research Public Preview:总参数 1T、激活参数约 49B 的原生多模态 MoE 架构,支持文本与图像输入,上下文窗口达 100 万 token。API 当日上线,开源权重版本计划 10 月底发布;Hugging Face 预发布页面(victormustar 转述)显示预计 10 月 31 日以开源形式放出,页面上激活参数写作 520 亿。这是 Mistral 迄今规模最大的开放权重旗舰,被视为欧洲开源阵营对标美国与中国头部开源模型的标志性动作。
已确认
- 模型规格:总参数 1T、激活参数约 49B(HF 预发布页面写为 520 亿),原生多模态 MoE 架构,支持文本与图像输入,上下文 100 万 token,视觉 grounding 能力据称超越部分闭源前沿模型。
- 官方定位:公司称其为按聚合基准「美欧最强」乃至「中国以外最强」的开源权重模型;在网络安全防御、制造、金融等关键工作负载上达到 SOTA,针对编程和网络防御做了优化。
- 训练基础设施:联合创始人 Guillaume Lample 披露,ML4 在位于 Bruyères-lès-Châtel 的欧洲自建数据中心、使用 3800 块 NVIDIA Grace Blackwell GPU 完成从预训练到后训练的全流程,全程在欧洲境内完成;NVIDIA 称其为「欧洲造的前沿级算力」。Lample 还预告 C/D 轮集群将上线。
- 发布节奏:API 已于发布当日上线,当前为 Research Public Preview,权重定于 10 月底(预计 10 月 31 日)开源。官方披露 RL 训练仍在继续并持续带来提升。
- 人评结果:Guillaume Lample 称在人类评估中,ML4 在 STEM、CAD 和金融任务上表现优于 GLM 5.3,在智能体编码上与其持平。LMArena 实测频道 Le Chonk 也已对模型跑了一轮真实场景评测。
- 媒体与社区反应:据 WIRED 报道(233C 转述),Mistral 将该模型定位为对抗 DeepSeek、Qwen 等中国开放权重模型的「欧洲回答」。Tansu Yegen 评价称欧洲不必在所有领域击败 OpenAI 或 Google、但不应被排除在 AI 竞赛之外。社区反应带有玩梗色彩,以「chonky」调侃模型体量。TestingCatalog 日报另指出,Google 与 OpenAI 多款模型同日亦有更新,发布节奏密集。
尚未确认
- 社区转述指出官方公布的基准数据存在缺失,具体性能表现有待独立评测验证,LMArena 实测的详细结果尚未公开汇总。
- 「胜过 GLM 5.3」「超越闭源模型」「中国之外最强」等主张均来自官方口径,尚无第三方验证。社区转发帖(steipete、beffjezos)提及的「竞品 Astra 训练用了 10 万块 GPU」的算力对比数字来自第三方推文,非官方数据。此前转述的「盲测编程排名第二、仅次 Opus 5」未见一手信源,暂不予采信。
为什么重要
- 1T 参数级别在欧洲开源阵营中具有标志性意义,直接对标美国与中国的头部开源模型,是开放权重竞赛中欧洲的一次重量级出手。
- 仅用 3800 块 Grace Blackwell 在欧洲本土完成万亿参数全流程训练,若性能主张经第三方验证,将对「大规模算力才有前沿模型」的行业假设构成挑战,并影响企业级模型选型格局。
- Mistral 发布 1T 参数 MoE 模型 Large 4,号称欧美最强开源权重模型 — Bam4d · 2026-10-06
- Mistral 发布 1T 参数开源模型 Large 4,主打多模态与网络安全 — MistralAI · 2026-10-06
- Mistral 发布万亿参数开源大模型 Mistral Large 4,激活仅 49B — testingcatalog · 2026-10-06
- Mistral 发布 1T 参数开放权重旗舰 Mistral Large 4 — reach_vb · 2026-10-06
- Mistral Large 4 发布:1T 参数 49B 激活,网友质疑基准数据缺失 — haider1 · 2026-10-06
- ML4 用 3800 块 Grace Blackwell 训练,Mistral 两轮新集群在路上 — GuillaumeLample · 2026-10-06
- Mistral ML4 广度评测达开源 SOTA,安全任务漏洞修复得分 82% — GuillaumeLample · 2026-10-06
- Mistral ML4 基准细节:金融法律工作流 SOTA,可跨表格幻灯片工作 — GuillaumeLample · 2026-10-06
- Mistral ML4 人评:STEM、CAD、金融超 GLM 5.3,智能体编码持平 — GuillaumeLample · 2026-10-06
- Mistral 发布万亿参数开源权重模型 ML4,人评胜 GLM 5.3 并欧洲扩招 — GuillaumeLample · 2026-10-06
- Mistral 发布万亿参数 Mistral Large 4,自称中国外最强开源权重模型 — nordicinst · 2026-10-06
- Mistral 发布 1T 参数多模态模型 Large 4,月底开源权重 — qtnx_ · 2026-10-06
- Mistral 发布 1T 参数大模型 ML4 预览版,49B 激活参数 — arthurmensch · 2026-10-06
- 3800 块 Grace Blackwell 上全流程训练 1T 参数模型,全程在欧洲完成 — qtnx_ · 2026-10-06
- Mistral 发布 1T 参数混合模型 Large 4,月底开放权重 — MaybeLiterally · 2026-10-06
- Mistral Large 4 上架 HF:1 万亿总参、520 亿激活,月底开源 — victormustar · 2026-10-06
- Sophia Yang:Mistral 在人类评测中全面胜过 GLM 5.3 — sophiamyang · 2026-10-06
- Mistral 官方发布 Mistral Large 4 Research Public Preview — MistralAI · 2026-10-06
- Mistral 发布 Le Chonk:1T 参数多模态模型,10 月底开源权重 — SIGKITTEN · 2026-10-06
- Mistral Large 4 发布:1 万亿参数 490 亿激活,月底开源权重 — uwukko · 2026-10-06
第 3 集 · Mistral Large 4 仍在 RL 训练,预计月底发布(2026-10-06,3 条)
据 X 用户 @qtnx 爆料及 Mistral 相关账号透露,Mistral Large 4(代号 le chonk)目前仍处于预览阶段,强化学习训练尚未结束,对比此前的 preview 版本持续看到提升,预计本月晚些时候正式开放使用。官方博客已公布预览版的部分评测结果,显示模型能力仍在稳步进步。
- Mistral Large 4 预览持续变强,RL 训练仍在跑,本月内开放 — qtnx_ · 2026-10-06
- Mistral Large 4 预览版持续评测,RL 训练仍在带来提升 — xeophon · 2026-10-06
- 爆料:Mistral Large 4 仍在 RL 训练,月底发布,实测持续进步 — DerpSenpai · 2026-10-06
第 4 集 · Mistral Large 4 评测:法国重回第三极,性价比遭质疑(2026-10-06,11 条)
10 月 6 日,Artificial Analysis 发布 Mistral Large 4 Research Public Preview 的完整评测:该模型总参数量 1T、激活 49B,Intelligence Index 得 38 分,跻身 Gemini/GPT 同梯队;评测方认为这是法国重回美中之外最强模型阵营的标志。权重计划月底开源,但高定价与 token 效率问题引发性价比争议。
已确认
- 模型规格与总评:1T 参数(激活 49B),Intelligence Index 得 38 分,与 Gemini/GPT 同梯队接近;完整评测结果页面已上线
- 国家排名:凭 38 分,法国升至前沿模型国家榜第三,仅次于美国(Claude Opus 5.5,58 分)和中国(MiMo-V2.6-Pro,46 分)
- 定价:每百万输入/输出 token 分别为 $1.36/$4.18,缓存输入 $0.14;上线前两周五折,折后每任务成本 $0.57,但整任务成本约 $1.13,仍为同级开源模型的 4 倍
- 性价比对比:每任务 $1.13 得 38 分,对比 MiMo v2.6 Pro 的 $0.13 得 46 分;与 GPT 6 Luna 同分但贵 16 倍(Luna 每任务约 $0.07)
- 网络安全能力:Cyber Index 得 50 分,与 GLM-5.3-Flash 持平,低于 MiMo-V2.6-Pro(56);评测方预计权重发布后其 Cyber 排名将进入开源模型前三
- 漏洞实测:针对其「开源模型中网络安全最强」的宣传,第三方用 VulnPR-100 基准实测(100 个含已知漏洞的 PR,每题限时 1 小时),Mistral Large 4 仅找出 35/100,效果不如中国开源模型;这一结果经 Mistral 联创 Guillaume Lample 转发
- 榜单对比:AI 研究者 Yuchen Jin 指出其在 Artificial Analysis Intelligence Index 上明显落后于 GLM-5.3,并调侃出现「评测危机」
- 独立评测者 haider 的测试显示:每完成一个任务,其输出 token 消耗是 GPT-6 sol 和 Astra 的 2 倍以上,成本效率堪忧
- 社区反响:BLUECOW009 嘲讽该模型为「le chaton skinny(瘦小猫)」,质疑 1T 参数规模下的性价比
尚未确认
- 月底开源 1T 级权重目前仅为官方计划,实际发布情况待观察
- 第三方对 38 分评价分歧:LuminaBench 认为 1T 参数模型仅得 38 分表现糟糕,但也有观点认为其分数与 GLM 5.x 等竞品相当,性价比评价尚无定论
为什么重要
- 若月底如约开源 1T 级权重,将显著改变开源模型竞争格局,法国也借此确立美中之外的第三极地位
- 能力与成本的错配是核心争议:分数不占优但整任务成本为同级开源模型数倍,且 token 消耗远超 GPT-6 系对手,实际采用可能受限
- 网络安全等专项能力仍落后中国头部开源模型(MiMo-V2.6-Pro),独立漏洞实测也不及国产开源模型,开源后排名变化值得跟踪
- Mistral Large 4 评测:法国重回美中之外最强,1T 参数月底开源 — ArtificialAnlys · 2026-10-06
- 国家前沿模型智力榜:法国凭 Mistral Large 4 升至第三 — ArtificialAnlys · 2026-10-06
- Mistral Large 4 定价公布:每任务 $1.13,为同级开源模型 4 倍 — ArtificialAnlys · 2026-10-06
- Mistral Large 4 网络安全能力:Cyber Index 50 分,权重开源后进前三 — ArtificialAnlys · 2026-10-06
- Artificial Analysis 公布 Mistral Large 4 完整评测榜单 — ArtificialAnlys · 2026-10-06
- Mistral Large 4 榜单落后 GLM-5.3,Yuchen 调侃「评测危机」 — Yuchenj_UW · 2026-10-06
- Mistral Large 4 每题耗 token 超 GPT-6 两倍,智能还不及对手 — haider1 · 2026-10-06
- Mistral 复苏:每美元智能比拼亮眼,1T 参数比 GLM 5.3 flash 低 3 分 — rickasaurus · 2026-10-06
- Mistral Large 4 智能指数仅得 38 分,1T 参数被指性价比差 — realmrfakename · 2026-10-06
- Mistral Large 4 得分仅 38,1 万亿参数被吐槽「瘦小猫」 — BLUECOW009 · 2026-10-07
- Mistral Large 4 漏洞实测:100 个 PR 找出 35 个,不如国产开源模型 — GuillaumeLample · 2026-10-07
第 5 集 · Mistral Large 4 预告上架 HF:1T 参数月底开源权重(2026-10-06,2 条)
Hugging Face 上出现 Mistral Large 4(代号 Le Chonk)的「Upcoming release」预告页。该模型为原生多模态架构,总参数约 1 万亿,激活参数 520 亿,权重将开放下载,预计本月月底发布。
- Mistral Large 4 预告上架 HF:1T 参数 52B 激活,月底开源权重 — LysandreJik · 2026-10-06
- Mistral Large 4 曝光:1 万亿参数 520 亿激活,本月底开源 — onetwoval · 2026-10-06
第 6 集 · Mistral 宣称 Large 4 为最强网络安全 AI 模型之一(2026-10-07,2 条)
Mistral AI 官方发文宣称,其最新模型 Mistral Large 4 是全球范围内网络安全领域最强的 AI 模型之一。这一说法目前仍属厂商单方宣称,未附带具体评测数据。安全公司 ReasonCoreAI 转发相关消息,并表示将配合开展面向科学任务的 SciCode 实测,届时或可验证该模型的真实能力。
- Mistral 宣称 Large 4 是全球最强网络安全 AI 模型之一 — scaling01 · 2026-10-07
- Mistral 宣称 Large 4 为全球最强网络安全模型,SciCode 实测已启动 — geoffwolfe · 2026-10-07
第 7 集 · Mistral Large 4 公测:万亿参数 MoE 月底开源(2026-10-10,2 条)
Mistral 于 10 月 6 日开启 Mistral Large 4 公开预览(外号 LeChonk):这是一款原生多模态模型,总参数约 1.05 万亿、激活参数仅约 490 亿的细粒度稀疏 MoE 架构,主打安全研究与补位定位,官方承诺本月底开放权重,成为开源社区关注的重磅模型。
- Mistral Large 4 预览:万亿参数开源主打安全研究补位 — 大模型之路 · 2026-10-10
- Mistral Large 4 开启公测:1 万亿参数、激活仅 490 亿 — dl_weekly · 2026-10-11