中科大等提出视觉预训练新范式:仅用 1/4 Token 超越纯文本

量子位 · wechat · 2026-07-31

中科大与上海人工智能实验室联合提出了一种全新的视觉预训练范式(VP)。研究发现,在真实的科学语料中,图片承载了文字无法无损翻译的视觉逻辑。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →