Cache-to-Cache 论文:让 LLM 直接用 KV 缓存互相交流
rochansinha · hn · 2026-09-19
arXiv 论文提出 Cache-to-Cache(C2C)方法,让大语言模型之间不再通过文本生成来沟通,而是直接进行语义层面的通信:将一个模型的 KV 缓存通过映射变换注入另一个模型的缓存空间,实现「缓存到缓存」的信息传递。这种方法绕开了「生成文本→解析」的信息瓶颈,作者声称在多模型协作任务上相比文本通信可降低延迟并提升效果,为多智能体系统的模型间通信提供了新范式。
「编程与Agent」频道最新
- 让 Agent 自己部署应用、再当真实用户测试,像高级模糊测试 — lucasmeijer · 2026-09-19
- 开发者经验:禁止 fallback,逼模型把核心功能做对 — Daniel_Farinax · 2026-09-19
- 银行仓库接 AI 问答三个月复盘:模型从来不是难点 — the_darkest_horse · 2026-09-19
- Codex 直接输出图表能力被低估,agent 编码体验再添一环 — Angaisb_ · 2026-09-19
- Notion 设计工程师 Geoffrey Litt 谈 AI 时代「理解成新瓶颈」 — EchoShao8899 · 2026-09-19
- Codex 内置 Images 2.5:先用图像模型重设计页面再实现 — OpenAIDevs · 2026-09-19