Dynamo 架构解析:将内存转化为定价以优化 GPU 路由
Abhishekcur · x · 2026-07-28
作者详细解析了 Dynamo 架构中关于 GPU 路由的巧妙设计:它没有将内存视为死板的规则,而是将其转化为一种动态定价。
- 价格而非规则:因为答案是数字而非规则,系统可以灵活放宽限制,让任务倾向于选择更便宜的 GPU,从而自然分散热量,同时不破坏原有的排序。
- 无锁检查:计算这个数字不会改变状态也不占用预留资源,因此路由器可以自由检查集群中的每个 GPU,仅在最后一步提交。
- 随机打破平局:当出现真正的平局时,系统通过抛硬币决定,这避免了全新集群中所有任务悄悄堆积到最先被检查的 GPU 上。
- 动态折扣收缩:最聪明的设计在于,随着 GPU 队列变长,其本地缓存的内存折扣会随之收缩,而常规内存或磁盘上的缓存折扣保持不变。
所属事件:NVIDIA Dynamo 用定价统一 LLM GPU 路由(14 条相关)→
「Infra」频道最新
- 拆解大疆无人机后 Sarah Guo 断言:深圳的制造知识学不来只能重建 — bookwormengr · 2026-09-23
- Ben Lorica:Agent 让数据栈不再容忍旧数据,「相关」不够要「实时为真」 — bigdata · 2026-09-23
- 128GB Strix Halo 跑 Qwen3.6 35B-A3B 稳定 50 tok/s,用户问现在最优解是什么 — jankeydankey · 2026-09-23
- Together AI 上线灰度发布:模型升级不停机,分步切流自动回滚 — togethercompute · 2026-09-23
- 专为大规模运行 Agent 的专用硬件亮相 — cyrilzakka · 2026-09-23
- 三元权重压缩 27B 模型仅 5.9GB,推理能力保留 95% — cephaloform · 2026-09-23