Melanie Mitchell 纠正「LLM」滥用:RLHF 后已非语言统计模型
MelMitchell1 · x · 2026-09-27
圣塔菲研究所的 Melanie Mitchell 参与了一场关于术语的讨论:她指出,现在人们常用「LLM」指任何包含预训练语言模型的大型 AI 系统,但这并非《随机鹦鹉》论文中的原始含义——那是她唯一想澄清的点。
她在追问中补充论证:任何让模型偏离语言一般统计特性的后训练(如 RLHF 或工具使用的 RL 训练),都使其不再是严格意义上「对人类语言结构建模的统计模型」。
所属事件:随机鹦鹉之争再起:Mitchell 称现有系统已非 LLM(28 条相关)→
「模型」频道最新
- 网友用 Opus 5.5 配 Midjourney 跑创意需求,马斯克直呼 Wow — tetsuoai · 2026-09-27
- 一次人设 prompt 微调让 ChatGPT 提哥布林多近 4000%,OpenAI 上线后才发现 — victor_explore · 2026-09-27
- NeurIPS 2026 论文:稀疏层是 Looped 语言模型规模化的关键 — burny_tech · 2026-09-27
- 小米 MiMo-V2.6 疑似将发 5 款模型,可见的有 1T、311B 和 9B — jacek2023 · 2026-09-27
- antirez:好程序员用 GPT 6 Astra 不见效,因为技能集变了 — antirez · 2026-09-27
- Opus 5.5 与 GPT-6 相隔 101 分钟发布,双雄开启降价战 — airesearch12 · 2026-09-27