后训练之后还是语言模型吗?研究者激辩 LLM 定义边界
burny_tech · x · 2026-09-27
针对 Melanie Mitchell 对 LLM 的批评,研究者 francip 提出技术性质疑:预训练、SFT、偏好优化和 RL 修改的都是同一套权重、同一个给出 token 条件分布的推理过程。后训练固然能彻底改变这个分布和它实现的行为,但这为什么就让模型「不再是语言模型」,而不是「一个为不同目标优化的语言模型」?他认为定义层面的否定并不成立。这是近来围绕「现代 LLM 还是不是 next-token predictor」争论的一部分。
所属事件:随机鹦鹉之争再起:Mitchell 称现有系统已非 LLM(28 条相关)→
「模型」频道最新
- 网友用 Opus 5.5 配 Midjourney 跑创意需求,马斯克直呼 Wow — tetsuoai · 2026-09-27
- 一次人设 prompt 微调让 ChatGPT 提哥布林多近 4000%,OpenAI 上线后才发现 — victor_explore · 2026-09-27
- NeurIPS 2026 论文:稀疏层是 Looped 语言模型规模化的关键 — burny_tech · 2026-09-27
- 小米 MiMo-V2.6 疑似将发 5 款模型,可见的有 1T、311B 和 9B — jacek2023 · 2026-09-27
- antirez:好程序员用 GPT 6 Astra 不见效,因为技能集变了 — antirez · 2026-09-27
- Opus 5.5 与 GPT-6 相隔 101 分钟发布,双雄开启降价战 — airesearch12 · 2026-09-27