DeepSeek 新版多轮改 System Prompt 不再击穿缓存,费用省 36.6%
teortaxesTex · x · 2026-09-11
博主 @yaogangqiang 实测 DeepSeek V4.1 Flash 配合新版 DSH Harness 的缓存改进。
- 多轮对话中途变更 System Prompt 曾导致前缀缓存失效、费用大增;新版下缓存仍可命中。
- 用新旧版 Harness 在 5 个固定场景做 20 组六轮任务对比:总 Token 仅多 2.4%,费用反降 36.6%;缓存命中率从 0% 升至 88.3%,完整会话非缓存输入减少 56.8%。
- 作者指出 Codex 已有类似功能,DeepSeek 无论模型还是 Harness 正在赶上。
「模型」频道最新
- 不改模型给 Qwen3-8B 加近似层,预填充时间砍半 — teortaxesTex · 2026-09-11
- Schmidhuber?不,是 rschu:Pro 20x 套餐不到一天烧掉 60% 额度 — rschu · 2026-09-11
- 网友热议 DeepSeek 新模型:K3 还是缩水版 K3-Flash? — teortaxesTex · 2026-09-11
- 6TB Fable 数据遭倒卖:内含小米华为等企业泄露密钥 — teortaxesTex · 2026-09-11
- AI Sextet 活动:6 模型 14 天完全免费,含 DeepSeek/Qwen/GLM — airesearch12 · 2026-09-11
- BullshitBench 榜单更新:GPT-6-Astra 领先历代 OpenAI 模型仍未及 Anthropic — scaling01 · 2026-09-11