Teknium 提醒:会话内频繁切换模型会使缓存失效、成本翻倍
AI 开发者 Teknium 提醒,在同一会话中频繁切换模型是错误做法:每次切换都会导致新模型上的提示词缓存(Prompt Cache)完全失效,用户必须为所有输入 token 重新全额付费,推理成本因此翻倍。他解释这是推理的基本原理,除非模型免费,开发者应尽量避免这种切换方式。
2026-08-25 ~ 2026-08-25 · 2 条相关
- 频繁切换模型会废掉缓存,推理成本翻倍 — Teknium · 2026-08-25
- 频繁切换模型会清除缓存,导致重复计费 — daniel_mac8 · 2026-08-25