Daniel Hanchen发布两小时开源模型与RL工作坊
Daniel Hanchen发布了一场长达两小时的深度工作坊视频,系统探讨了当前大模型领域的核心议题。内容涵盖了开源与闭源模型的差异及推理能力对模型进化速度的影响、基准测试作弊现象、蒸馏与强化学习技术,以及如何防治reward hacking。此外,视频还深入讲解了动态量化与内存优化等推理部署层面的关键实践。
2026-07-21 ~ 2026-07-21 · 2 条相关
- 两小时工作坊讲透开放模型、作弊基准与动态量化 — danielhanchen · 2026-07-21
- Daniel Hanchen 2 小时 workshop 讲开源模型、reward hacking 和 RL — danielhanchen · 2026-07-21