Braco 视觉 token 压缩144倍仍保95.2%精度,端到端提速约36%

Rui Zhong · hf · 2026-09-30

论文从「token 参数化」视角重新审视视觉-语言模型的极端视觉 token 压缩:把基变换与结构化截断(决定可压缩性)与坐标组织(决定可学习性与跨模态对齐)分开分析。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →