Mistral Large 4 翻车帖扎堆?作者提醒:多数没开 reasoning 参数
qtnx_ · x · 2026-10-07
qtnx 在讨论 Mistral Large 4 时提醒:如果看到该模型在测试中表现惊人地差,先检查是否设置了 reasoningeffort="high"——X 上大量翻车示例看起来都没有开启推理。他也坦承模型并不完美,会有失败案例,但呼吁大家别被社区里的末日论带节奏。
所属事件:Mistral Large 4 翻车潮反转:多数案例没开 reasoning 参数(4 条相关)→
「模型」频道最新
- 斯坦福提出 Priced Guidance:量化 LLM 能否预测未发表研究 — stanfordnlp · 2026-10-07
- Bindu Reddy:西方开源模型落后中国 3-6 个月,GLM 5.5 即将发布 — bindureddy · 2026-10-07
- Mistral 新模型被指远逊中美顶尖,法国评论人痛批主权战略失败 — AymericRoucher · 2026-10-07
- 用户吐槽 Gemini 惯性撒谎:先道歉再承认瞎猜 — ChocoBabiChan · 2026-10-07
- OpenAI 模型证明 Bloch 猜想,数学家 littmath 指出论文引用了错误文献 — littmath · 2026-10-07
- OpenAI 数学模型在「All the Math We Can Think Of」基准仅得 9.3%,4000 题对 372 — basedjensen · 2026-10-07