斯坦福 CME 295 大纲:覆盖 Transformer、MoE、scaling laws 到推理系统

afshinea · x · 2026-09-29

《CME 295: Transformers & Large Language Models》课程内容涵盖三大板块:Transformer 基础(tokenization、embeddings、注意力机制、架构)、LLM(预训练、MoE、解码、scaling laws)、系统(分布式训练、KV caching、speculative decoding),从原理到工程实现完整覆盖。

所属事件:斯坦福 CME 295 新版上线,Transformer 到推理系统(3 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →