DeepMind 研究员:这一批评早在 ChatGPT 时代就已成立

burny_tech · x · 2026-09-27

DeepMind 研究员 Nathaniel Daw 在与 Melanie Mitchell 的争论中补刀:instruction tuning 和 RLHF 让模型行为偏离纯 next-token 预测这件事,至少从 ChatGPT 问世起就已成立,而 stochastic parrots 论文虽有提及,但作者们并未因 instruction tuning 与 RLHF 的出现而撤回其核心批评。这是该争论线索中的一环。

所属事件:随机鹦鹉之争再起:Mitchell 称现有系统已非 LLM(28 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →