频繁切换模型会清除缓存,导致重复计费

daniel_mac8 · x · 2026-08-25

@Teknium 指出,在同一会话中频繁切换模型是错误的做法。因为每次切换都会导致新模型的 Prompt Cache(提示词缓存)失效,用户必须为所有的输入 tokens 重新全额付费。除非模型免费,否则应停止这种操作,这是推理服务的基本机制。

所属事件:Teknium 提醒:会话内频繁切换模型会使缓存失效、成本翻倍(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →