NVIDIA 与 Solidigm 重写存储规则:允许丢失的 KV Cache
shashib · x · 2026-08-02
NVIDIA 与 Solidigm 正联合设计一种直接置于 GPU 内存层级中的固态硬盘,以应对大语言模型中不断膨胀的 KV cache。
核心逻辑在于:由于高带宽内存(HBM)成本高达每 TB 一万美元,将溢出的上下文推送到闪存上更为划算。这种新架构允许存储设备丢失部分数据字节,因为在此场景下,数据丢失仅意味着触发重新计算,而不再被视为严重的数据损坏事件。
「Infra」频道最新
- Tobi 开源 walgit:无数据库的单二进制 Git 服务器 — jevon · 2026-08-24
- s3collections:用S3构建分布式系统持久化数据结构 — andersonbcdefg · 2026-08-24
- 预测市场:年底前美一州实施数据中心禁令概率 68% — Polymarket · 2026-08-24
- Ramp 用本地模型省钱,引发业界对 AI 成本反思 — annetgriffin · 2026-08-24
- GitHub Actions 额度耗尽,是时候迁移到自建 VPS 了吗? — MicahBerkley · 2026-08-24
- Ubuntu 计划成为 RISC-V CPU 的参考操作系统 — bookwormengr · 2026-08-24