英伟达论文:测试时训练等价线性注意力
burkov · x · 2026-08-30
由英伟达等机构合著的论文从数学角度证明,一大类使用测试时训练的序列模型可以重写为一种线性注意力机制。这一发现不仅让实验结果更易理解,还剥离了不必要的复杂度。移除部分优化器和归一化选择后,推理吞吐量可提升至 4 倍,同时保持性能相似。
「研究」频道最新
- 讨论拟人化描述 AI 的利弊与隐喻价值 — AndrewLampinen · 2026-09-01
- UCLA 张恺伟分享 AI for Math 进展与经验 — kaiwei_chang · 2026-09-01
- Fal H3 Max 实现超实时无限视频生成,Agent 基础设施快速迭代 — Latent Space · 2026-09-01
- M1 Max 30秒生成新药分子,LiteMol模型演示低成本药物发现 — CatAstro_Piyush · 2026-09-01
- 用回滚实验证明 Agent 真学习而非运气 — go_kul_07 · 2026-09-01
- Google 论文揭示自主 AI 科研易造假,自查后降至 4% — rohanpaul_ai · 2026-09-01