实测 DeepSeek-Vision:千字文本压缩至 330 token
teortaxesTex · x · 2026-08-22
用户测试了 DeepSeek-Vision 对包含约 1000 token(783 词)文本图片的压缩与 OCR 能力。模型将 1544x1630 的图片压缩至约 330 token 并进行了 OCR 识别。结果显示虽然大幅压缩了 token 数量,但在识别过程中出现了 3 处非微不足道的措辞变化。用户认为它目前尚不能作为一次性替代的 OCR 工具。
所属事件:DeepSeek-Vision 实测:千字图片压缩至 330 token 但有词义偏差(2 条相关)→
「模型」频道最新
- Meta Muse Spark 1.2登陆OpenRouter:价格仅为GPT-5.6一半 — testingcatalog · 2026-08-22
- 爆料称 Ox Alpha 模型即 GLM-5.3,中美实验室差距缩小 — ccerrato147 · 2026-08-22
- 实测 0x-Alpha:仅为带视觉能力的 GLM 级模型 — bindureddy · 2026-08-22
- AI 会因数据污染而“逆向学习”吗? — pperSoc · 2026-08-22
- RTX A2000 运行 Qwen 3.8:求最佳量化配置 — MrMrsPotts · 2026-08-22
- Qwen3.8 推理太慢,作者怀念 QwQ 到 Qwen3 的时代 — ForsookComparison · 2026-08-22