DeepSeek v4 PRO Q2 实测:VRAM/RAM 混合推理达 45 t/s

antirez · x · 2026-08-17

antirez 展示了在 DGX Station 上运行 DeepSeek v4 PRO Q2 模型的优化成果。通过将路由专家模型拆分至 VRAM 和 RAM,并针对该特定配置优化内核,实现了 45 t/s 的推理速度,并预计未来可以更快。作者称这证明了 DwarfStar 作为工作站推理引擎的潜力。

所属事件:Redis作者优化DeepSeek V4推理速度达45 t/s(3 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →