NVIDIA 宣布 Nemotron 上 RTX Spark,DeepSeek V4 Flash 仅需 60GB 内存

ryanshrout · x · 2026-10-08

在微软 Windows AI 相关活动中,Ryan Shrout 披露:NVIDIA 将为 RTX Spark 带来新的 Nemotron 模型,支持与云端混合的本地推理方案;同时宣布一个 DeepSeek V4 Flash 版本,仅需 60GB 内存即可运行。前一条推文提到 HydraFusion 现在会为编码任务做模型路由到本地算力,即“混合智能”架构:本地小模型处理部分任务,云端大模型兜底。

所属事件:微软Surface发布会携手英伟达推RTX Spark,Windows全面转向本地AI(14 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →