佐治亚理工 2026 版 LLM 课程:覆盖 MoE、自博弈 RL 与扩散语言模型
cocoweixu · x · 2026-08-18
Wei Xu 更新了佐治亚理工 CS 8803「大语言模型」课程,阅读清单按主题组织:预训练、嵌入、MoE、推理与对齐、Agent、长上下文、注意力机制、强化学习(GRPO/DAPO/R1-Zero 式训练)、测试时 scaling、扩散语言模型、安全与可解释性等。
- 代表性论文包括 Chameleon 数据混合框架、DeepSeek-V2/V3.2、DPO、Attention Sink、Absolute Zero 自博弈推理等。
- 课程从 2026 年 1 月开讲,附完整课表与论文链接,适合作为系统性的 LLM 学习路线图。
所属事件:佐治亚理工发布 2026 版大语言模型课程大纲(2 条相关)→
「研究」频道最新
- Dyna Robotics 复盘:百万小时第一视角视频训练机器人,基础设施全面失效 — ZeYanjie · 2026-08-18
- 详解开源 MoE RL 零偏差训练:原理与消融实验 — PandaAshwinee · 2026-08-18
- 实现 MoE RL 零训练推理偏差,Wordle 任务提升求解率 — PandaAshwinee · 2026-08-18
- Continual Learning 一词被滥用,应拆解为四种机制 — gleech · 2026-08-18
- 数据实测:Z-Image Abliterated 编码器未解除审查 — nathandreamfast · 2026-08-18
- ECCV 2026 将举办第三届 3D HUMANS 研讨会 — dimadamen · 2026-08-18