排查 LLM 缓存失效的工具

t4a8945 · reddit · 2026-07-18

作者为本地优先的 LLM harness 做了一个排查工具 cache-hunter,用来捕捉调用里哪些变化会触发缓存失效。

它解决什么问题

在本地跑模型时,prefill 成本会因为缓存失效变得很明显,常见原因包括:

使用方式

之后工具会实时展示 session,并用红色单元格标出不稳定的字段。

作者的观察

他已经拿自己的 harness 以及 OpenCode、Claude Code、Cline、Pi、Hermes、Vibe 测过,很多都暴露出:

作者的结论是:这类缓存稳定性检查应该成为 harness 的标准测试项。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →