Mistral Large 4 每题耗 token 超 GPT-6 两倍,智能还不及对手
haider1 · x · 2026-10-06
独立评测者 haider 对 Mistral Large 4 的 Intelligence Index 结果显示:每完成一个任务,其输出 token 消耗是 GPT-6 sol 和 Astra 的 2 倍以上,成本效率堪忧。作者此前对比还指出,Mistral Large 4 大致与领先的开源权重模型持平,可能是当前最强的西方开源模型,但 Mistral 官方尚未公布完整基准对比。
「模型」频道最新
- GLM 5.3 全量 NVFP4 可在 4 张 B200 或 H200 上部署 — TheZachMueller · 2026-10-06
- 用户投诉 OpenAI dot 静默耗尽用量额度并扣 credits — badhiyahai · 2026-10-06
- Mistral Large 4 在监管知识基准上登顶,被称最懂欧盟法规 — japie06 · 2026-10-06
- Anthropic 研究员称 Claude ML4 已越过递归自我改进环境门槛 — Fluke_Ellington · 2026-10-06
- 疑似智谱 GLM 5.3 浮出水面,讨论者称其对手非 Flash 版本 — TheZachMueller · 2026-10-06
- 在提示词前加「Okay」可让 Olmo-3-7B 的 MATH-500 准确率从 42% 升至 78% — arankomatsuzaki · 2026-10-06