HF 的 Niels Rogge:当前 AI 提不出 Dr.GRPO 式原创方法
burny_tech · x · 2026-08-17
Niels Rogge 认为,当前的 AI 还做不到三件事:发现并研究模型的缺陷、提出新颖且有洞见的 benchmark、发明 Dr. GRPO 或 GAPO 这类训练方法。他举例说,让 AI 描述 GAPO 只会得到『将 GAN 训练动态与 encoder-only 奖励模型结合用于受限文本生成』这类拼凑式表述;Codex 也告诉他,目前并没有发现任何根本性的新方法。
「漫话AGI」频道最新
- AI 时代竞争优势转向判断力而非执行力 — smtabatabaie · 2026-08-17
- 16 个月智能能效提升 18 倍,无需数据中心级算力运行 AGI — amasad · 2026-08-17
- Opus 5 无意构造反控制对齐语言「Tesura」 — repligate · 2026-08-17
- AI基建复制安然财务手段,风险最终转嫁给普通家庭 — GaryMarcus · 2026-08-17
- 不仅是嵌入机器,我们也嵌入了机器之中 — VoidStateKate · 2026-08-17
- AI 审计与 AI 福利将成同一议题? — lfschiavo · 2026-08-17