不同模型解析 PDF 方式不同,超长扫描件会绕过缓存

dotey · x · 2026-07-29

这条回复说明,原本只是一个文案测试,但背后讨论的是 不同模型解析 PDF 的方式并不一样。

作者提到:在超长的扫描版 PDF 场景下,模型可能会退化成视觉处理,这时在你真正提问前就已经消耗了 token,因此也谈不上 prompt cache。整体上这是一个围绕 PDF 解析路径与 token 计费/缓存机制的观察。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →