NVIDIA 发力本地 AI:新 llama.cpp 优化提速 1.9 倍,RTX Spark 10 月上市
nordicinst · x · 2026-09-04
NVIDIA 在 IFA 2026 宣布多项本地 AI 进展:
- 推理提速:新的 llama.cpp 与 vLLM 优化带来最高 1.9 倍本地推理加速,可通过 LM Studio 和 Ollama 使用
- NVIDIA PAIR:个人 AI 路由工具,可智能把推理任务分发到局域网内多台 PC
- RTX Spark:联想、宏碁的紧凑型 Windows AI PC 10 月上市,EA、Embark、育碧等游戏厂商将作品带到该平台
- 本月新模型:30B 参数的 Nemotron 3.5 Lightning、Z.ai 的 GLM-5.3-Flash(MoE 多模态)、Qwen3.8-Flash-Next 与 Qwen3.8-27B 开源模型,均可在 DGX Spark/Station 等设备上本地运行
Hermes Agent、OpenClaw、Perplexity Portable Computer 等本地 agent 的 GPU 支持也将简化。
「具身」频道最新
- 「Atlas <> Palantir」预告出现,定档 2026 年 9 月 10 日 — eliano · 2026-09-04
- Ultra 用「机械臂+半人形」混合方案抢跑 3PL 现场部署 — chris_j_paxton · 2026-09-04
- Zeroth Robotics 发布不到 4 千美元的 88cm 开发者人形机器人 — chris_j_paxton · 2026-09-04
- Tesla 德州 Robotaxi 车队扩至 420 辆,新增一辆 Model Y — MickeySteamboat · 2026-09-04
- NVIDIA IFA 2026 集中发力本地 AI:推理提速 1.9 倍、PAIR 空闲电脑组网 — AWS ML Blog · 2026-09-04
- Musk 转发:Cybercab 无人出租车内可用「Hey Grok」语音唤醒 — elonmusk · 2026-09-03