专题 · FULL STORY

Mistral Large 4:从预告到公测的开源旗舰

路透社先行预告后,Mistral于10月6日官宣万亿参数旗舰模型Large 4(代号Le Chonk),开启Research Public Preview,强化学习训练仍在进行、开源权重预计月底放出。Artificial Analysis等评测称其助法国重回第三极,但性价比遭到质疑。

2026-10-06 ~ 2026-10-11 · 7 集 · 108 条

第 1 集 · Mistral 即将发布新旗舰,自称部分领域超越中国模型(2026-10-06,2 条)

据路透社报道,法国 AI 公司 Mistral 将于当日发布一款大型新旗舰模型。CEO Arthur Mensch 表示,该模型在某些方面超越中国模型,包括网络安全领域,并强调这是「欧洲」的成果。Reddit 用户引述该表态后,评论区普遍认为这一说法听起来过于夸张,对新模型的实际表现持观望态度。

第 2 集 · Mistral 发布万亿参数开源旗舰 Large 4(2026-10-06,86 条)

Mistral 于 10 月 6 日官宣旗舰开放权重模型 Mistral Large 4(代号 Le Chonk)并开启 Research Public Preview:总参数 1T、激活参数约 49B 的原生多模态 MoE 架构,支持文本与图像输入,上下文窗口达 100 万 token。API 当日上线,开源权重版本计划 10 月底发布;Hugging Face 预发布页面(victormustar 转述)显示预计 10 月 31 日以开源形式放出,页面上激活参数写作 520 亿。这是 Mistral 迄今规模最大的开放权重旗舰,被视为欧洲开源阵营对标美国与中国头部开源模型的标志性动作。

已确认

  • 模型规格:总参数 1T、激活参数约 49B(HF 预发布页面写为 520 亿),原生多模态 MoE 架构,支持文本与图像输入,上下文 100 万 token,视觉 grounding 能力据称超越部分闭源前沿模型。
  • 官方定位:公司称其为按聚合基准「美欧最强」乃至「中国以外最强」的开源权重模型;在网络安全防御、制造、金融等关键工作负载上达到 SOTA,针对编程和网络防御做了优化。
  • 训练基础设施:联合创始人 Guillaume Lample 披露,ML4 在位于 Bruyères-lès-Châtel 的欧洲自建数据中心、使用 3800 块 NVIDIA Grace Blackwell GPU 完成从预训练到后训练的全流程,全程在欧洲境内完成;NVIDIA 称其为「欧洲造的前沿级算力」。Lample 还预告 C/D 轮集群将上线。
  • 发布节奏:API 已于发布当日上线,当前为 Research Public Preview,权重定于 10 月底(预计 10 月 31 日)开源。官方披露 RL 训练仍在继续并持续带来提升。
  • 人评结果:Guillaume Lample 称在人类评估中,ML4 在 STEM、CAD 和金融任务上表现优于 GLM 5.3,在智能体编码上与其持平。LMArena 实测频道 Le Chonk 也已对模型跑了一轮真实场景评测。
  • 媒体与社区反应:据 WIRED 报道(233C 转述),Mistral 将该模型定位为对抗 DeepSeek、Qwen 等中国开放权重模型的「欧洲回答」。Tansu Yegen 评价称欧洲不必在所有领域击败 OpenAI 或 Google、但不应被排除在 AI 竞赛之外。社区反应带有玩梗色彩,以「chonky」调侃模型体量。TestingCatalog 日报另指出,Google 与 OpenAI 多款模型同日亦有更新,发布节奏密集。

尚未确认

  • 社区转述指出官方公布的基准数据存在缺失,具体性能表现有待独立评测验证,LMArena 实测的详细结果尚未公开汇总。
  • 「胜过 GLM 5.3」「超越闭源模型」「中国之外最强」等主张均来自官方口径,尚无第三方验证。社区转发帖(steipete、beffjezos)提及的「竞品 Astra 训练用了 10 万块 GPU」的算力对比数字来自第三方推文,非官方数据。此前转述的「盲测编程排名第二、仅次 Opus 5」未见一手信源,暂不予采信。

为什么重要

  • 1T 参数级别在欧洲开源阵营中具有标志性意义,直接对标美国与中国的头部开源模型,是开放权重竞赛中欧洲的一次重量级出手。
  • 仅用 3800 块 Grace Blackwell 在欧洲本土完成万亿参数全流程训练,若性能主张经第三方验证,将对「大规模算力才有前沿模型」的行业假设构成挑战,并影响企业级模型选型格局。

还有 66 条相关讨论 →

第 3 集 · Mistral Large 4 仍在 RL 训练,预计月底发布(2026-10-06,3 条)

据 X 用户 @qtnx 爆料及 Mistral 相关账号透露,Mistral Large 4(代号 le chonk)目前仍处于预览阶段,强化学习训练尚未结束,对比此前的 preview 版本持续看到提升,预计本月晚些时候正式开放使用。官方博客已公布预览版的部分评测结果,显示模型能力仍在稳步进步。

第 4 集 · Mistral Large 4 评测:法国重回第三极,性价比遭质疑(2026-10-06,11 条)

10 月 6 日,Artificial Analysis 发布 Mistral Large 4 Research Public Preview 的完整评测:该模型总参数量 1T、激活 49B,Intelligence Index 得 38 分,跻身 Gemini/GPT 同梯队;评测方认为这是法国重回美中之外最强模型阵营的标志。权重计划月底开源,但高定价与 token 效率问题引发性价比争议。

已确认

  • 模型规格与总评:1T 参数(激活 49B),Intelligence Index 得 38 分,与 Gemini/GPT 同梯队接近;完整评测结果页面已上线
  • 国家排名:凭 38 分,法国升至前沿模型国家榜第三,仅次于美国(Claude Opus 5.5,58 分)和中国(MiMo-V2.6-Pro,46 分)
  • 定价:每百万输入/输出 token 分别为 $1.36/$4.18,缓存输入 $0.14;上线前两周五折,折后每任务成本 $0.57,但整任务成本约 $1.13,仍为同级开源模型的 4 倍
  • 性价比对比:每任务 $1.13 得 38 分,对比 MiMo v2.6 Pro 的 $0.13 得 46 分;与 GPT 6 Luna 同分但贵 16 倍(Luna 每任务约 $0.07)
  • 网络安全能力:Cyber Index 得 50 分,与 GLM-5.3-Flash 持平,低于 MiMo-V2.6-Pro(56);评测方预计权重发布后其 Cyber 排名将进入开源模型前三
  • 漏洞实测:针对其「开源模型中网络安全最强」的宣传,第三方用 VulnPR-100 基准实测(100 个含已知漏洞的 PR,每题限时 1 小时),Mistral Large 4 仅找出 35/100,效果不如中国开源模型;这一结果经 Mistral 联创 Guillaume Lample 转发
  • 榜单对比:AI 研究者 Yuchen Jin 指出其在 Artificial Analysis Intelligence Index 上明显落后于 GLM-5.3,并调侃出现「评测危机」
  • 独立评测者 haider 的测试显示:每完成一个任务,其输出 token 消耗是 GPT-6 sol 和 Astra 的 2 倍以上,成本效率堪忧
  • 社区反响:BLUECOW009 嘲讽该模型为「le chaton skinny(瘦小猫)」,质疑 1T 参数规模下的性价比

尚未确认

  • 月底开源 1T 级权重目前仅为官方计划,实际发布情况待观察
  • 第三方对 38 分评价分歧:LuminaBench 认为 1T 参数模型仅得 38 分表现糟糕,但也有观点认为其分数与 GLM 5.x 等竞品相当,性价比评价尚无定论

为什么重要

  • 若月底如约开源 1T 级权重,将显著改变开源模型竞争格局,法国也借此确立美中之外的第三极地位
  • 能力与成本的错配是核心争议:分数不占优但整任务成本为同级开源模型数倍,且 token 消耗远超 GPT-6 系对手,实际采用可能受限
  • 网络安全等专项能力仍落后中国头部开源模型(MiMo-V2.6-Pro),独立漏洞实测也不及国产开源模型,开源后排名变化值得跟踪

第 5 集 · Mistral Large 4 预告上架 HF:1T 参数月底开源权重(2026-10-06,2 条)

Hugging Face 上出现 Mistral Large 4(代号 Le Chonk)的「Upcoming release」预告页。该模型为原生多模态架构,总参数约 1 万亿,激活参数 520 亿,权重将开放下载,预计本月月底发布。

第 6 集 · Mistral 宣称 Large 4 为最强网络安全 AI 模型之一(2026-10-07,2 条)

Mistral AI 官方发文宣称,其最新模型 Mistral Large 4 是全球范围内网络安全领域最强的 AI 模型之一。这一说法目前仍属厂商单方宣称,未附带具体评测数据。安全公司 ReasonCoreAI 转发相关消息,并表示将配合开展面向科学任务的 SciCode 实测,届时或可验证该模型的真实能力。

第 7 集 · Mistral Large 4 公测:万亿参数 MoE 月底开源(2026-10-10,2 条)

Mistral 于 10 月 6 日开启 Mistral Large 4 公开预览(外号 LeChonk):这是一款原生多模态模型,总参数约 1.05 万亿、激活参数仅约 490 亿的细粒度稀疏 MoE 架构,主打安全研究与补位定位,官方承诺本月底开放权重,成为开源社区关注的重磅模型。