Dynamo 把每块 GPU 的路由问题压成一个总成本

Abhishekcur · x · 2026-07-27

Dynamo 把排队、占用和缓存统一成一个分数

这段 thread 的核心技巧是:不再把排队、占用空间、缓存命中拆成几个独立决策。

也就是说,它不是“先看内存,再看负载”,而是先把所有成本合并成一个统一的目标函数。

所属事件:NVIDIA Dynamo 用定价统一 LLM GPU 路由(14 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →