GitHub 开源项目完整复现 LLM 训练全流程,纯 PyTorch 手写算法
thisguyknowsai · x · 2026-08-15
一位开发者 Fareed Khan 在 GitHub 上发布了 train-llm-from-scratch 项目,完整展示了从原始数据到现代对齐推理模型的训练流程,所有算法均用纯 PyTorch 手写,不依赖 trl、peft 或 transformers 库。项目涵盖预训练(基于 Attention is All You Need)、SFT、奖励模型、DPO、PPO、GRPO(DeepSeek-R1 方法)等阶段,并提供理论文档、手绘图表和代码。该项目的价值在于提供了 LLM 训练的完整教学资源。
「编程与Agent」频道最新
- MathCode Agent:将自然语言数学题转为 Lean 4 证明 — tom_doerr · 2026-08-15
- 开源 MCP-md-reader:优化 Markdown 读取效率 — JoseEstevez22 · 2026-08-15
- Codex 插件优化长任务轮询,大幅降低 token 消耗 — ssh4net · 2026-08-15
- Codex 项目记忆插件:基于 MCP 的本地持久化 — ssh4net · 2026-08-15
- 四大 AI Agent 框架设计哲学对比 — jasonkneen · 2026-08-15
- Lazar 框架:基于 Rust 的受控自演进设计 — jasonkneen · 2026-08-15