CUDA 13.4 发布:Windows on Arm 支持、Rubin 架构预览与 GPU 共享新控制
kimmonismus · x · 2026-09-10
NVIDIA 官方博客详解 CUDA Toolkit 13.4 主要更新:
- Windows on Arm 支持:CUDA 应用开发扩展到 Arm 平台上的 Windows,不再限于 Linux on Arm;此前已预告 10 月 RTX Spark 笔记本将用于本地 AI 模型和个人智能体。
- Rubin 架构预览:为 Rubin(compute capability 107)提供功能性预览支持,开发者可提前移植应用。
- MPS V3:全新控制层,提供可脚本化 CLI、命名服务实例、TOML 配置和基于 cgroup 的 GPU 显存限制,实现容器化环境中精确的 GPU 分区。
- CUDA Compute Fabric Transport:面向通信库开发者的传输中心 API,通过命名逻辑端点和异步操作跨 NVLink fabric 传输数据。
- CUDA Python:cuda.core 1.1.0 增加纹理/表面编程、NUMA 感知的托管内存和 .pyi 类型存根;cuda.compute 1.1 支持 CCCL 算法跨多 GPU 架构的 AOT 编译。
- CCCL 3.4:Blackwell GPU 上 warp 特化的 cub::DeviceScan 最高达 92% 内存带宽利用率,并带来 CUB 全设备算法单调用 API、批量 warp 归约和 cuda::std 中的 C++ 标准库并行算法。
所属事件:CUDA 13.4 登陆 Windows on Arm,为 RTX Spark 笔记本铺路(2 条相关)→
「Infra」频道最新
- GPU 指数与 Token 指数信号相反:算力升值、智能降价的 AI 经济悖论 — sudoraohacker · 2026-09-10
- FlashAttention 五代进化全解:为何省 HBM 流量比算力更关键 — techNmak · 2026-09-10
- Kepler Computing隐身7年出山:用铁电3D堆叠绕开EUV造HBM替代品,融资4.68亿美元 — Promptmethus · 2026-09-10
- Hugging Face 沙箱失守后,云端多租户隔离还能撑多久 — WonderFactory · 2026-09-10
- mlx-omarchy 0.4.0 发布:Apple Silicon 上跑 Linux 也能用 MLX 调 GPU — alexcovo_eth · 2026-09-10
- Gemini V4.1 预训练算力估算:约 5e24 FLOPs,4K 块 B300 两周可跑完 — teortaxesTex · 2026-09-10