Yandex Research:把 KV-cache 当运行时,让 LLM 无需训练即可并发交互

RichmanRonald · x · 2026-09-17

Yandex Research 发布博客,探讨如何用 KV-cache 的共享与调度,让预训练 LLM 在不额外训练的情况下同时「观察、推理、行动」。

这是把 agent 交互架构从「模型训练问题」重新定义为「推理时系统设计问题」的思路,值得架构方向的研究者关注。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →