VGGT-Prime:用路由给注意力头分级,削减视觉几何 Transformer 冗余算力

zhenjun_zhao · x · 2026-09-22

论文 VGGT-Prime 从架构冗余而非 token 冗余的角度加速 VGGT 类前馈视觉几何模型。研究发现全局注意力层中仅一部分注意力头携带关键几何信息。

方法是用轻量路由器为每个全局注意力头估计合适的计算级别,动态分配到三种计算模式:均值池化/代理注意力/完整 softmax 注意力。在保持有竞争力的重建质量的同时大幅降低随输入视角数二次增长的计算开销,多数据集实验验证了有效性。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →