Teknium 提醒:会话内频繁切换模型会使缓存失效、成本翻倍

AI 开发者 Teknium 提醒,在同一会话中频繁切换模型是错误做法:每次切换都会导致新模型上的提示词缓存(Prompt Cache)完全失效,用户必须为所有输入 token 重新全额付费,推理成本因此翻倍。他解释这是推理的基本原理,除非模型免费,开发者应尽量避免这种切换方式。

2026-08-25 ~ 2026-08-25 · 2 条相关