KV-cache grafting:冻结小模型也能变强

Corbenci · hf · 2026-07-17

用 KV-cache grafting 把冻结小模型变得更便宜也更强

这篇工作提出一种不改权重就能提升小模型能力、同时降低推理成本的方法:把已验证的知识以字节精确(byte-exact)的 KV 状态存起来,之后再 graft 回新的推理上下文中。

核心特性

结果

作者把它描述成一种“verified-knowledge flywheel”:知识一次验证,多次复用。

所属事件:KV缓存拼接法瞄准冻结小模型增强(2 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →