不同模型解析 PDF 方式不同,超长扫描件会绕过缓存
dotey · x · 2026-07-29
这条回复说明,原本只是一个文案测试,但背后讨论的是 不同模型解析 PDF 的方式并不一样。
作者提到:在超长的扫描版 PDF 场景下,模型可能会退化成视觉处理,这时在你真正提问前就已经消耗了 token,因此也谈不上 prompt cache。整体上这是一个围绕 PDF 解析路径与 token 计费/缓存机制的观察。
「模型」频道最新
- Claude Opus 5 登顶 LisanBench,medium 模式更省 token — scaling01 · 2026-07-29
- Bindu Reddy 称 OpenAI 与 Anthropic 在 Kimi K3 上制造恐慌 — bindureddy · 2026-07-29
- Claude 泄露 CoT 被玩成 Anthropic 模型梗图 — OwariDa · 2026-07-29
- Reddit 讨论称 Qwen 可能已难复现 3.6 级别的紧凑质量 — Leflakk · 2026-07-29
- 阿里 Qwen 启动 QwenGrowthPlan 收集 Qwen3.8 真实任务反馈 — pmttyji · 2026-07-29
- Google 将 Gemini Interactions API 推向 GA,改用 REST 和 SSE — _philschmid · 2026-07-29