Apple 发布新模型:长文档先转页面图片省 token,再按问题调取原文

yoobinray · x · 2026-09-25

Apple 在 Hugging Face 上发布了一个新开源模型。该模型基于 Qwen3.5-9B 微调,思路是先把长文档压缩成小尺寸的页面图片以节省 token,再根据用户问题检索并调出相关页面的完整文本。这种「视觉压缩+按需取回原文」的混合方式旨在降低长上下文处理的成本。

所属事件:苹果开源 LensVLM-9B:页面图片压缩省 token 按需调取原文(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →