博主点评新模型技术报告:基准成绩惊人,KV 缓存缩小 4 倍
stochasticchasm · x · 2026-09-11
一位技术向博主在阅读某新模型技术报告时指出:该模型的基准成绩高得离谱,且相比 dsv4-flash,KV cache 缩小了 4 倍——这对推理显存与长上下文成本影响很大。作者还预告后续会将其与 yoco 架构做对比。细节以原报告为准。
所属事件:DeepSeek 新模型技术报告:KV Cache 缩小 4 倍(3 条相关)→
「Infra」频道最新
- 云上全 AI 论破产:企业 AI 正回流本地与混合基础设施 — DavidLinthicum · 2026-09-11
- ThunderKittens 登上 Vera Rubin:NVFP4 GEMM 跑出 22 PFLOPS — togethercompute · 2026-09-11
- 开源 Go 网关:拦截 Agent 失控循环并按 run 归因 LLM 花费 — SnooCauliflowers2631 · 2026-09-11
- 2×RTX 3090 + 512GB DDR5 本地跑大模型,如何冲上 15 t/s? — levoniust · 2026-09-11
- 用远程 Agent 重建家庭实验室:工具与检查比 LLM 本身更关键 — HankYeomans · 2026-09-11
- 开源 LayerLens:按 token×层粒度剖析 LLM 推理耗时 — Dry_Mixture130 · 2026-09-11