NVIDIA IFA 2026 集中发力本地 AI:推理提速 1.9 倍、PAIR 空闲电脑组网
AWS ML Blog · rss · 2026-09-04
NVIDIA 在 IFA 2026 联合微软及伙伴集中宣布本地 AI 生态进展:
- 推理提速:llama.cpp 在 RTX 5090 上最高提升 1.9 倍吞吐,vLLM 在 RTX PRO 6000 上提升 1.2 倍、双 DGX Spark 集群提升 1.4 倍,均可在 LM Studio 和 Ollama 中使用。
- NVIDIA PAIR:免费开源的 Personal AI Router,自动发现局域网内兼容 PC 并将 AI 推理任务分发到多台空闲电脑。
- 本地 agent 一键化:Hermes Agent、OpenClaw(GitHub 最大 AI 项目,38 万 star)和 Perplexity Portable Computer 将支持在 Windows 上一键配置本地模型;Portable Computer 可本地跑完整工作流,需要时按权限升级到 15+ 云端前沿模型。
- RTX Spark 硬件:10 月上市联想、宏碁新机。
- 本地可跑的新模型:Nemotron 3.5 Lightning(30B)、GLM-5.3-Flash(MoE)、Qwen3.8-Flash-Next 与 Qwen3.8-27B、LTX 2.5 视频、MiniMax-H3 及 FastH3(4 步蒸馏提速 7 倍)、Meta Muse Glimmer(30B)、DeepSeek v4 Flash(284B MoE,13B 激活,双 DGX Spark 可跑)。
「具身」频道最新
- Anthropic MHS 实验踩坑:模型不该管实时物理控制 — Empty-Abalone-2952 · 2026-09-04
- 自研还是代工?人形机器人路线之争引热议 — chris_j_paxton · 2026-09-04
- Sentdex 实测:通用多模态 LLM 直接操控四足机器人,无需训练 — Sentdex · 2026-09-04
- 「Atlas <> Palantir」预告出现,定档 2026 年 9 月 10 日 — eliano · 2026-09-04
- Ultra 用「机械臂+半人形」混合方案抢跑 3PL 现场部署 — chris_j_paxton · 2026-09-04
- Zeroth Robotics 发布不到 4 千美元的 88cm 开发者人形机器人 — chris_j_paxton · 2026-09-04