NVIDIA 宣布 Nemotron 上 RTX Spark,DeepSeek V4 Flash 仅需 60GB 内存
ryanshrout · x · 2026-10-08
在微软 Windows AI 相关活动中,Ryan Shrout 披露:NVIDIA 将为 RTX Spark 带来新的 Nemotron 模型,支持与云端混合的本地推理方案;同时宣布一个 DeepSeek V4 Flash 版本,仅需 60GB 内存即可运行。前一条推文提到 HydraFusion 现在会为编码任务做模型路由到本地算力,即“混合智能”架构:本地小模型处理部分任务,云端大模型兜底。
所属事件:微软Surface发布会携手英伟达推RTX Spark,Windows全面转向本地AI(14 条相关)→
「Infra」频道最新
- GitHub Copilot 可将任务交给本地模型 MAI-Code-1.1 Flash — mariorod1 · 2026-10-08
- 微软联合 Nvidia 推 Surface Spark:128GB 内存售价 6000 美元 — casper_hansen_ · 2026-10-08
- Google 发射首颗搭载 4 颗 TPU 的测试卫星,推进太空算力计划 — CurieuxExplorer · 2026-10-08
- GPU 租赁平台 Lium:出租率创新高,闲置 GPU 也有保底收益 — const_reborn · 2026-10-08
- MRVL 揭与谷歌芯片协议:推理加速器最高 1200 亿美元,TPU 旁的解码芯片成关键 — demian_ai · 2026-10-08
- llama.cpp 登上微软 Windows 发布会大屏,作者ggerganov感慨软硬栈合流 — ggerganov · 2026-10-08