Margaret Mitchell 澄清争议论文研究对象是基座模型
mmitchell_ai · x · 2026-09-28
Hugging Face 研究者 Margaret Mitchell 在回应 @BlancheMinerva 与 @MelMitchell1 的讨论时澄清:其所著论文明确讨论的是「预训练」「无监督」的语言模型,而非经过后训练的模型。
她补充说明,虽然关于后训练如何影响模型内部表征确实存在重要讨论,但那篇论文本身的焦点始终是基座模型。这场争论源于对论文适用范围的解读分歧,Mitchell 强调应回到论文原文表述来判断。
所属事件:Mitchell 称「现有系统已非 LLM」引爆随机鹦鹉论战(31 条相关)→
「模型」频道最新
- 分类模型 Jev 爆火:把早晨新闻筛查从 20 条扩到 500 条 — every · 2026-09-28
- 五家前沿 AI 造塑料桥:Opus 5.5 设计承重约 130 磅近 5 倍碾压 — 141_1337 · 2026-09-28
- PrismML 三值压缩 Qwen3.8 27B 至 5.9GB,能力保留 98.2% — dl_weekly · 2026-09-28
- 曝 DeepSeek V4.1 Pro 已现身内部灰度测试,默认高推理 — teortaxesTex · 2026-09-28
- 免费在线 LLM 原理全指南:从 token 到本地部署全链路 — JFPuget · 2026-09-28
- Opus 5.5 长任务易卡死,用户被迫每 20 分钟设检查点 — paul_cal · 2026-09-28