Nvidia 新论文:让 LLM 稀疏化提速,95% 静默神经元可被跳过

YesThisIsLion · x · 2026-09-14

转发内容介绍 Nvidia 与研究者的新论文:LLM 前馈层中约 95% 的神经元对任一给定词完全静默,模型本身天然稀疏,但现代 GPU 为密集矩阵运算设计,不规则的稀疏内存访问反而导致更慢,管理空隙的开销吃掉了节省。

论文提出自定义稀疏化方案,证明 transformer LLM 可以同时做到更稀疏、更快、更小,且不损失精度,模拟大脑按需激活神经元的效率方式。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →