thdxr 解析 DeepSeek 高缓存命中率:千项细节优化堆出来的护城河
thdxr · x · 2026-09-19
mitsuhiko 提问:为什么 DeepSeek 能做到远超同行的聚合缓存命中率,难点到底在分布式缓存本身,还是缓存复用特别难?thdxr 回应称,缓存命中率更多反映的是整体工程优化水平:DeepSeek 做了上千件小优化,从数据中心建设到软件栈,任何一环被跳过或做错都会掉链子,而且整套系统高度针对自家模型和产品定制。他补充说,即便租到 1000 张 GPU(本身就很难),通用配置下也几乎无法复现这种效果;OpenAI 和 Anthropic 同样出色,但他指的是可供第三方自托管托管托管托管的模型。
「Infra」频道最新
- 跑 Emacs 刷 X 的自建主机现比汽车还贵,GPU 涨价梗图走红 — tetsuoai · 2026-09-19
- M4 每周期可执行 10 条指令,超多数竞品,M5 提速另有玄机 — lemire · 2026-09-19
- Apple M6 核心数增至12,作者解析CPU仍在快速进步 — lemire · 2026-09-19
- Apple M2 到 M5 三年性能提升约 50%, gradual 无跳跃式增长 — lemire · 2026-09-19
- OpenAI 揭秘推理路由:比例控制器为何换成全局优化器 — AI Engineer · 2026-09-19
- DGX Spark 双机太贵,本地 AI 硬件 affordability 引热议 — FlolightC · 2026-09-19