哈佛研究:LLM 服务缓存效率受流量模式影响

rohanpaul_ai · x · 2026-08-18

哈佛与芝加哥大学联合研究分析了 61.2 亿个请求、跨越 9174 个模型的一年生产数据。

主要发现:

结论:现有的合成基准测试无法反映长期生产环境,路由、缓存和容量规划应基于真实流量的历史和结构。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →