在已后训练模型上再训练会「炸坏」模型:能力退化与 reality drift

Sauers_ · x · 2026-10-06

一条被引用的讨论指出,一个常见的捷径是在已经后训练(post-trained)的模型上继续训练,但这往往会「炸坏」模型:能力退化、模型偏好变得不稳定,并引发 reality drift——模型开始分不清什么是真实的、什么是虚构的。转发者感叹「我们正处在一个迷人的时间线」。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →