NVIDIA 宣布 Nemotron 上 RTX Spark,DeepSeek V4 Flash 仅需 60GB 显存
ryanshrout · x · 2026-10-08
NVIDIA 高管 Ryan Shrout 表示,NVIDIA 将为 RTX Spark 带来新的 Nemotron 模型,用于同一混合推理方案;同时宣布一个 DeepSeek V4 Flash 版本,仅需 60GB 内存即可运行。此外他还呼吁 llama.cpp 也接入 Windows ML。
所属事件:微软Surface发布会携手英伟达推RTX Spark,Windows全面转向本地AI(14 条相关)→
「Infra」频道最新
- GitHub Copilot 可将任务交给本地模型 MAI-Code-1.1 Flash — mariorod1 · 2026-10-08
- 微软联合 Nvidia 推 Surface Spark:128GB 内存售价 6000 美元 — casper_hansen_ · 2026-10-08
- Google 发射首颗搭载 4 颗 TPU 的测试卫星,推进太空算力计划 — CurieuxExplorer · 2026-10-08
- GPU 租赁平台 Lium:出租率创新高,闲置 GPU 也有保底收益 — const_reborn · 2026-10-08
- MRVL 揭与谷歌芯片协议:推理加速器最高 1200 亿美元,TPU 旁的解码芯片成关键 — demian_ai · 2026-10-08
- llama.cpp 登上微软 Windows 发布会大屏,作者ggerganov感慨软硬栈合流 — ggerganov · 2026-10-08