中国团队开源 Cache-to-Cache:LLM 免文字直接语义通信

Scobleizer · x · 2026-09-18

中国研究团队开源了 Cache-to-Cache(C2C)通信范式,让多个 LLM 协作时无需生成中间文字。现状是 agent 之间必须把内部「想法」翻译成文本 token 再传递,丢失语义且带来逐 token 延迟;C2C 用神经网络把源模型的 KV-cache 直接投影融合进目标模型,实现纯语义通信,并引入可学习门控机制选择哪些层最适合缓存迁移。效果:完全避开中间文本生成延迟,相比单模型准确率最高提升 14.2%。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →