斯坦福 CME 295 大纲:覆盖 Transformer、MoE、scaling laws 到推理系统
afshinea · x · 2026-09-29
《CME 295: Transformers & Large Language Models》课程内容涵盖三大板块:Transformer 基础(tokenization、embeddings、注意力机制、架构)、LLM(预训练、MoE、解码、scaling laws)、系统(分布式训练、KV caching、speculative decoding),从原理到工程实现完整覆盖。
所属事件:斯坦福 CME 295 新版上线,Transformer 到推理系统(3 条相关)→
「公司和人」频道最新
- Kaggle 创始人细数社区渊源:GPT-3 论文一作与 OpenAI 联创都从这里走出 — antgoldbloom · 2026-09-29
- VC 视角:EDA 芯片设计反馈环太长,AI 智能体难有用武之地 — ai · 2026-09-29
- Foresight 旧金山办 AI 科学大会,DeepMind、MIT 等多方出席 — juanbenet · 2026-09-29
- Miles Brundage:OpenAI 安全问题根子在文化与决策流程 — Miles_Brundage · 2026-09-29
- 秋叶拓哉开讲 Kimi K3:28000 亿参数开源巨模型的架构拆解 — tkasasagi · 2026-09-29
- 斯坦福 Code in Place 推新课:随意用 AI 写码,但必须当场讲明白 — chrispiech · 2026-09-29