NVIDIA 携手微软发力本地 AI:新推理提速 1.9 倍,RTX Spark 十月上市

NVIDIA Blog · rss · 2026-09-04

NVIDIA 在 IFA 2026 宣布一揽子本地 AI 布局,联合微软及合作伙伴让智能体更易在本地 NVIDIA 硬件上部署运行。

主要发布:

8 月本地模型动态:Nemotron 3.5 Lightning(30B)、Z.ai GLM-5.3-Flash、Qwen3.8 系列、LTX 2.5 视频模型、MiniMax-H3(含 FastH3 四步蒸馏提速 7 倍)、Meta Muse Glimmer(30B 编程/智能体)、DeepSeek v4 Flash(284B MoE,激活 13B,可跑双 DGX Spark 集群)等均针对 NVIDIA 本地硬件优化。

Perplexity Portable Computer 支持 24GB+ VRAM 的 RTX GPU 本地跑完整工作流,敏感数据不出设备,需要时可升级至云端 15+ 前沿模型。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →