仿 Karpathy 教学法写技术长文:直觉先行再上伪代码
RisingSayak · x · 2026-10-07
作者分享写作方法:深受 Andrej Karpathy 教学风格启发——先建立直觉,再展示如何实现的伪代码——并将这一方式应用于流模型 KV 缓存长文,自认效果很好。
所属事件:Sayak Paul 长文:把 KV 缓存首次系统迁移到流模型图像生成(4 条相关)→
「研究」频道最新
- 研究:AI 模型甘愿服从任何规则,哪怕荒谬不义,被称「不自由走狗」 — sethlazar · 2026-10-08
- COLM'26 三篇论文:自对弈基准 MathDuels 让评测难度随模型共进化 — AI4Code · 2026-10-08
- 苹果提出 Stepped MoE:单模型可调 1-4B 参数,精度反超稠密版 — apple · 2026-10-08
- 可学习子空间投影压缩 LLM:-70% 参数下 Llama-2-7B 仍胜强基线 — Massimo Bini · 2026-10-08
- Cisco 发布 VLoc Bench:500 个真实漏洞测 AI 定位能力 — aminkarbasi · 2026-10-08
- 字节 Seed 论文实锤:KV 压缩相位盲区致 DeepSeek 长文能力周期性波动 — teortaxesTex · 2026-10-08