实测 DeepSeek Harness:GLM 与 Kimi 缓存命中率近 99%
sandyyevans · reddit · 2026-08-19
博主测试了 DeepSeek Harness (DSH) 框架在接入 GLM、Kimi、Opus 等非 DeepSeek 模型时的 Prompt Caching(提示词缓存)效果。结果显示,GLM 在工具循环中达到 97% 缓存复用,下一轮达 99.6%;Kimi 两轮均达 99%。这证明 DSH 的追加式请求模式能有效适配其他支持前缀缓存的上游模型。相比之下,Opus 在该测试中未显示缓存活动。
「Infra」频道最新
- Dyna-2 用 100 万小时第一视角视频训练,公开数据基建细节 — Scobleizer · 2026-08-19
- TensorRT Model Connect 开源发布,两条命令接入 HF 模型推理 — JFPuget · 2026-08-19
- 本地跑 AI Bot 噪音有多大?实测风扇狂转如喷气 — Daniel_Farinax · 2026-08-19
- 16GB M5 MacBook Air 跑 MiniMax H3:VPipe 比 h3.c 快 25% — TgoAI · 2026-08-19
- 英伟达垄断难破?唯有计算范式变革才能突围 — 2C_ornot2C · 2026-08-19
- Anthropic 的 Astra 推理多级监控机制曝光 — AccBalanced · 2026-08-19