Apple 发布新模型:长文档先转页面图片省 token,再按问题调取原文
yoobinray · x · 2026-09-25
Apple 在 Hugging Face 上发布了一个新开源模型。该模型基于 Qwen3.5-9B 微调,思路是先把长文档压缩成小尺寸的页面图片以节省 token,再根据用户问题检索并调出相关页面的完整文本。这种「视觉压缩+按需取回原文」的混合方式旨在降低长上下文处理的成本。
所属事件:苹果开源 LensVLM-9B:页面图片压缩省 token 按需调取原文(5 条相关)→
「模型」频道最新
- Cerebras 订阅计划实价 500 美元,页面显示 600 系含 VAT — testingcatalog · 2026-09-25
- 曝 GPT-6 Sol 机器人任务成绩达 GPT-5.6 的 1.6 倍且便宜 47% — ycombinator · 2026-09-25
- OpenRouter 榜单:前十仅 Luna 一个闭源模型,开源全面爆发 — bindureddy · 2026-09-25
- Every 用日常工作自建基准实测 GPT-6 Sol 对阵 Opus 5.5 — every · 2026-09-25
- Bland Speech v3 发布:盲听评测 Elo 1237,TTS 真实度直逼真人 — ycombinator · 2026-09-25
- AI Explained 深读 Opus 5.5:自动化 AI 研究还有多远 — AI Explained · 2026-09-25