HF 的 Niels Rogge:当前 AI 提不出 Dr.GRPO 式原创方法

burny_tech · x · 2026-08-17

Niels Rogge 认为,当前的 AI 还做不到三件事:发现并研究模型的缺陷、提出新颖且有洞见的 benchmark、发明 Dr. GRPO 或 GAPO 这类训练方法。他举例说,让 AI 描述 GAPO 只会得到『将 GAN 训练动态与 encoder-only 奖励模型结合用于受限文本生成』这类拼凑式表述;Codex 也告诉他,目前并没有发现任何根本性的新方法。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →