Weka 推出KV Cache卸载方案

AccBalanced · x · 2026-07-12

Weka 提到他们做出了一种面向 KV Cache 的预 HBF 配置,利用 E-W 网络把缓存卸载到接近 LPDDR 的速度,目标是支撑从 PB 到 EB 级别的 KV Cache 容量。

他们强调这种方案可以做到 不淘汰缓存、不过度重复 prefill,并表示接下来会测试这种“token attention warehouse”在 VR + LPX 场景中的 activations;同时还提到来自 Oracle Cloud 的一个 agentic swarm profile。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →