Stanford CS25 讲义更新:涵盖从 Tokenizer 到 Transformer 全栈
tengyuma · x · 2026-08-19
Stanford CS25 课程(Transformers United)的讲师更新了讲义。这套讲义被视为最清晰的端到端教程之一,详细解释了 ChatGPT 和 Claude 等模型的构建原理。
内容涵盖范围极广:
- 从基础的 Tokenization 和 BPE
- 到核心的 Transformer 架构
- 再到 训练管线 和 Next-token Decoding
无论是初学者还是每日部署 Agent 的工程师,都能从中获益。讲师表示该领域发展迅速,讲义将长期处于“进行时”状态,并欢迎反馈指正。
「研究」频道最新
- FAR 框架助力 AI 数学研究,解出 1977 年猜想 — wellecks · 2026-08-19
- 研究揭示 LLM 控制机械臂表现糟糕,定位与推理存缺陷 — tom_doerr · 2026-08-19
- AlphaFold 在 TNFα 蛋白预测上表现超预期 — MoAlQuraishi · 2026-08-19
- 神经研究:手写比打字更能激活全脑连接 — CurieuxExplorer · 2026-08-19
- 专家反驳 Anthropic:设计结合剂并非药物研发的完美代理 — rapha_gl · 2026-08-19
- 趣事:Qwen 模型学贪吃蛇竟学会了“骑墙”生存 — mervenoyann · 2026-08-19