三篇论文殊途同归:循环复用算力让掩码模型不加深不增参

LucaAmb · x · 2026-09-05

【转发 @jdeschena】Looped models are all the rage right now, join us on Monday for even more looping ➰➰➰

@diffusionllms 盘点了三篇方向趋同的新工作,核心洞见一致:与其加大参数量,不如复用计算,把原本在训练时固定的"深度"变成推理时可支配的资源。

作者预告周一将有更多关于 looped models 的内容。

所属事件:三篇论文同证:循环复用算力可让掩码模型不加深不增参(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →