推荐:Transformers 架构最严谨的数学解释之一
stanfordnlp · x · 2026-08-21
Stanford NLP 转发了一个关于 Transformer 架构的资源,该资源被认为是目前对 LLM 底层架构最清晰、最严谨的数学解释之一,适合深入理解其原理。
「研究」频道最新
- Zetta ζ 登顶 RoboCasa 榜单,实现 11 倍推理加速 — NielsRogge · 2026-08-21
- EMNLP 论文对比人类:VLM 如何学会映射全新视觉概念 — benno_krojer · 2026-08-21
- Andrew 锐评多智能体系统需建立实证且可解释的科学 — soumitrashukla9 · 2026-08-21
- 斯坦福论文:LLM 内部对「当前年份」编码分裂,提示词也改不掉 — stanfordnlp · 2026-08-21
- BNAIC'26 图学习与推理研讨会征稿 — pbloemesquire · 2026-08-21
- 商汤 SenseNova U1.5 开源:MoT 架构匹敌 Nano Banana 2 — multimodalart · 2026-08-21