后训练之后还是语言模型吗?研究者激辩 LLM 定义边界

burny_tech · x · 2026-09-27

针对 Melanie Mitchell 对 LLM 的批评,研究者 francip 提出技术性质疑:预训练、SFT、偏好优化和 RL 修改的都是同一套权重、同一个给出 token 条件分布的推理过程。后训练固然能彻底改变这个分布和它实现的行为,但这为什么就让模型「不再是语言模型」,而不是「一个为不同目标优化的语言模型」?他认为定义层面的否定并不成立。这是近来围绕「现代 LLM 还是不是 next-token predictor」争论的一部分。

所属事件:随机鹦鹉之争再起:Mitchell 称现有系统已非 LLM(28 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →