播客:DeepMind研究总监谈文本扩散模型与RL
ziv_ravid · x · 2026-08-15
zivravid发布新一期播客,邀请Google DeepMind研究总监Brendan O'Donoghue讨论文本扩散模型。话题包括:质量不是瓶颈而是服务成本、Gamma扩散模型适合构建、扩散输出多样性助力RL、采样器是最大开放问题、硬件趋势利好扩散而非自回归、RL仍被低估。
「研究」频道最新
- 探讨因果模型与机制模型的定义差异 — sirbayes · 2026-08-15
- New England 机械可解释性研讨会首日举行 — benno_krojer · 2026-08-15
- 新论文呼吁 NLP 研究者关注模型长期福祉对齐 — 996roma · 2026-08-15
- 论文揭示 LM Head 成为梯度瓶颈,权重绑定引关注 — JFPuget · 2026-08-15
- Weights Unknown 会议聚焦扩展与智能体 — DynamicWebPaige · 2026-08-15
- Epoch 研究员列出决定 AI 影响的四大关键问题 — Jsevillamol · 2026-08-15