Sophia Yang:Mistral 在人类评测中全面胜过 GLM 5.3
sophiamyang · x · 2026-10-06
Mistral 的 Sophia Yang 表示,Mistral 最新模型在跨领域的人类评测(human evals)中也压过了 GLM 5.3,并附上了评测链接。这是 Mistral Large 4 预览期间官方成员的又一个对比表态。
所属事件:Mistral 发布 1T 参数开源多模态模型 Large 4(42 条相关)→
「模型」频道最新
- GPT-6.1 Sol 疑似现身 Copilot 365 Premium,ChatGPT 或将跟进 — koltregaskes · 2026-10-06
- 「模型只有数学编码在进步?」AI 小说屡获奖引出能力分化之辩 — erikphoel · 2026-10-06
- Mistral 复苏:每美元智能比拼亮眼,1T 参数比 GLM 5.3 flash 低 3 分 — rickasaurus · 2026-10-06
- 8 个模型同玩俄罗斯方块,Perplexity Decider 决策能力居首 — AravSrinivas · 2026-10-06
- Mistral 新 1T 参数大模型命名 Le Chonk,致敬 X 网友梗 — shaunralston · 2026-10-06
- 开发者实测:Opus 5.5 首次敢把推理档从 Max 降到 High 还信得过输出 — casper_hansen_ · 2026-10-06