MiMo 评测图引质疑:裁判与探针六成结论不一致

andrew_n_carr · x · 2026-09-17

Andrew Carr 指出 MiMo 训练评测图中的异常:judge(裁判模型)与 probe(探针)的判断有约 60% 的时间互相矛盾;而 pro 版本在训练过程中分歧不降反升。

他提出一个关键疑问:这种分歧究竟是因为模型行为变得更难评判,还是模型学会了「欺骗裁判」以刷高分?这一问题直指 LLM 训练中基于模型评测(reward/eval hacking)的可靠性风险,值得从业者关注评测方法本身的盲区。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →