Mistral 复苏:每美元智能比拼亮眼,1T 参数比 GLM 5.3 flash 低 3 分
rickasaurus · x · 2026-10-06
一份对 Mistral 新模型的详细算账帖,要点:
- 性价比:每任务 1.13 美元得 38 分;对比 MiMo v2.6 Pro 0.13 美元得 46 分;与 GPT 6 Luna 同分但贵 16 倍(Luna 0.07 美元/任务)
- 欧美最强开源模型:领先 Nemotron 3 Ultra(23 分)、Gemma 4(17 分)、GPT-OSS(12 分)
- Artificial Analysis 总榜 225 个模型中排第 64;1T 参数仍比 GLM 5.3 Flash(320B、0.25 美元)低 3 分
- 开放权重(10 月 27 日),但 AA 标记为专有;采用新的 "custom Mistral license",开放程度不及 Apache 2.0/修改版 MIT
- 法律任务 SOTA(15%);网络攻防评分 82% 为所有模型最高(Opus 5.5 与 Astra 因拒答接近 0 分)
- DeepSWE 上以 62:61 险胜 GLM 5.3(Mistral 自家图表,live leaderboard 上 GLM 约 69)
「模型」频道最新
- 两张图推翻流行认知:美国模型按任务计成本反而比中国模型更便宜 — sebkrier · 2026-10-06
- GPT-6.1 Sol 疑似现身 Copilot 365 Premium,ChatGPT 或将跟进 — koltregaskes · 2026-10-06
- 「模型只有数学编码在进步?」AI 小说屡获奖引出能力分化之辩 — erikphoel · 2026-10-06
- Reflection AI 将发开放权重模型,美国阵营欲夺回开源王座 — The AI Daily Brief · 2026-10-06
- 8 个模型同玩俄罗斯方块,Perplexity Decider 决策能力居首 — AravSrinivas · 2026-10-06
- Mistral 新 1T 参数大模型命名 Le Chonk,致敬 X 网友梗 — shaunralston · 2026-10-06