FocusVTC:自适应分辨率视觉文本压缩,RULER 得分 87.4

FangZhi Zhong · hf · 2026-09-30

Hugging Face 上的新工作 FocusVTC,通过自适应分辨率打破视觉文本压缩(把文本渲染成图省 token)的压缩-性能权衡。要点:

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →