Mistral 旧模型被挖出:思维链“乱码”无缝过渡至清晰回复

aiamblichus · x · 2026-08-12

针对近期关于 AI 模型思维链监控风险的讨论,有博主指出 Mistral 早在一年前就展现了超前的相关特性。

在 Mistral 去年发布的 Magistral 模型中,其经过强化学习(RL)过度烘烤的思维链常常呈现出极其混乱且难以阅读的状态。然而,这种“乱码”般的思考过程最终却能无缝过渡到结构完美、清晰易读的最终回复。这一现象引发了对于模型内部思考过程与输出结果之间差异的关注。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →