斯坦福教授:扩散模型让推理像训练,GPU终于干回本行

victor_explore · x · 2026-09-21

引用 Inception CEO、斯坦福教授 Stefano Ermon 的观点:Transformer 当年取代 RNN 修复了训练,但推理从未得到同样修复——模型必须先有前9个token才能写第10个,导致 GPU 大部分时间在搬运权重而非做计算。扩散模型正是推理侧的修复方案:它让推理过程看起来像训练,这正是硬件原本被设计出来适配的形态。作者因此主张,推理速度是一种架构选择,而非更大的集群能解决的问题。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →