实测 DeepSeek-Vision:千字文本压缩至 330 token

teortaxesTex · x · 2026-08-22

用户测试了 DeepSeek-Vision 对包含约 1000 token(783 词)文本图片的压缩与 OCR 能力。模型将 1544x1630 的图片压缩至约 330 token 并进行了 OCR 识别。结果显示虽然大幅压缩了 token 数量,但在识别过程中出现了 3 处非微不足道的措辞变化。用户认为它目前尚不能作为一次性替代的 OCR 工具。

所属事件:DeepSeek-Vision 实测:千字图片压缩至 330 token 但有词义偏差(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →