7 个 GitHub 仓库带你从零吃透 LLM:从 Transformer 到亲手训练
goyalshaliniuk · x · 2026-08-19
作者整理了 7 个系统学习 LLM 的 GitHub 仓库,声称不需要读几十篇零散教程就能从 Transformer 基础进阶到自己构建和训练语言模型。本条介绍第 1 个:Sebastian Raschka 的 LLMs-from-scratch(103k star),配套其著作《Build a Large Language Model (From Scratch)》,用 PyTorch 逐步实现注意力、Transformer、预训练与微调,还有 reasoning-from-scratch 等附章代码。线程中提到的其他仓库包括:Karpathy 的 nanoGPT、minGPT(约 300 行极简 GPT 实现,已半归档,建议转向 nanoGPT)和 llm.c(纯 C/CUDA 训练 GPT-2,比 PyTorch Nightly 快约 7%,30.8k star);以及 Hugging Face 的 LLM Course(免费多语言课程,覆盖 Transformers/Datasets/Tokenizers)和 Transformers 库(164k star)。
所属事件:7 个 GitHub 仓库助你从零精通 LLM(2 条相关)→
「编程与Agent」频道最新
- Obsidian + Claude Code 打造 AI 责任执行系统 — tom_doerr · 2026-08-19
- Alchemy 作者:面向 Agent 时代的极简云基础设施工具 — samgoodwin89 · 2026-08-19
- 软件工程基本功在Agent时代比以往更重要 — tokenbender · 2026-08-19
- 教程:在 Quarkus 中为无状态 MCP 工具授权 — myfear3 · 2026-08-19
- BuilderIO 开源编码 Agent 技能库,支持视觉规划与屏幕上下文恢复 — tom_doerr · 2026-08-19
- 开发者构想自托管 MCP 认证代理:统一处理 OAuth 静默刷新 — Valuable-Ticket-6879 · 2026-08-19