DeepMind 研究员:这一批评早在 ChatGPT 时代就已成立
burny_tech · x · 2026-09-27
DeepMind 研究员 Nathaniel Daw 在与 Melanie Mitchell 的争论中补刀:instruction tuning 和 RLHF 让模型行为偏离纯 next-token 预测这件事,至少从 ChatGPT 问世起就已成立,而 stochastic parrots 论文虽有提及,但作者们并未因 instruction tuning 与 RLHF 的出现而撤回其核心批评。这是该争论线索中的一环。
所属事件:随机鹦鹉之争再起:Mitchell 称现有系统已非 LLM(28 条相关)→
「模型」频道最新
- 网友用 Opus 5.5 配 Midjourney 跑创意需求,马斯克直呼 Wow — tetsuoai · 2026-09-27
- 一次人设 prompt 微调让 ChatGPT 提哥布林多近 4000%,OpenAI 上线后才发现 — victor_explore · 2026-09-27
- NeurIPS 2026 论文:稀疏层是 Looped 语言模型规模化的关键 — burny_tech · 2026-09-27
- 小米 MiMo-V2.6 疑似将发 5 款模型,可见的有 1T、311B 和 9B — jacek2023 · 2026-09-27
- antirez:好程序员用 GPT 6 Astra 不见效,因为技能集变了 — antirez · 2026-09-27
- Opus 5.5 与 GPT-6 相隔 101 分钟发布,双雄开启降价战 — airesearch12 · 2026-09-27