中国团队开源 Cache-to-Cache:LLM 免文字直接语义通信
Scobleizer · x · 2026-09-18
中国研究团队开源了 Cache-to-Cache(C2C)通信范式,让多个 LLM 协作时无需生成中间文字。现状是 agent 之间必须把内部「想法」翻译成文本 token 再传递,丢失语义且带来逐 token 延迟;C2C 用神经网络把源模型的 KV-cache 直接投影融合进目标模型,实现纯语义通信,并引入可学习门控机制选择哪些层最适合缓存迁移。效果:完全避开中间文本生成延迟,相比单模型准确率最高提升 14.2%。
「研究」频道最新
- CAIS 发布 HLE-Rolling:持续更新的「人类最后考试」替代版 — devindkim · 2026-09-18
- RLE-Bench:机器人自生长身体完成任务,暴露编码Agent物理推理短板 — daibond_alpha · 2026-09-18
- ENCODE GRAMMAR 模型文档改用交互式 HTML README 替代静态 PDF — anshulkundaje · 2026-09-18
- Aspen 世界模型×物理研讨会明年2月办,10月9日截止摘要 — randall_balestr · 2026-09-18
- Cell 专刊:生物医学需要能预测干预结果的世界模型 — rishabh16_ · 2026-09-18
- RLHF 之后又有 RLCD:用强化学习让 LLM 的置信度可校准 — prdeepakbabu · 2026-09-18