KV缓存拼接法瞄准冻结小模型增强
一项名为 KV-cache grafting 的方法提出,将已验证知识预先保存为可恢复的 KV 状态,并在推理时以与重算字节级一致的方式直接拼接使用。该方案无需改动模型权重,目标是在冻结小模型上同时提升能力并降低推理成本,作者并以 Gemma 4 12B 结果作为展示。
2026-07-17 ~ 2026-07-19 · 2 条相关
- KV-cache grafting:冻结小模型也能变强 — Corbenci · 2026-07-17
- 冻结Gemma4的KV缓存拼接法 — MindPsychological140 · 2026-07-19