NVIDIA Vera Rubin 实测:Agent 负载吞吐量提升 30 倍
Scobleizer · x · 2026-08-25
NVIDIA 首次公布 Vera Rubin 芯片在真实 Agent 工作负载下的实测数据。基于 SemiAnalysis 的 AgentX 工作负载和 DeepSeek V4 Pro 模型,结果显示其每兆瓦吞吐量较 GB300 NVL72 提升 30 倍,Token 成本降低 35%。这验证了 Agent 会话与聊天或摘要工作负载的本质不同:其上下文在数百步中增长至数十万 Token,需要全新的软硬件优化。
所属事件:NVIDIA 公布 Vera Rubin 实测:Agent 场景效能超 GB300 达 30 倍(5 条相关)→
「编程与Agent」频道最新
- AI 智能体大多只是套了 LLM 的增强版工作流引擎 — Financial_Ad_7297 · 2026-08-30
- 苹果 Agent Seer 论文:直接由 MCP 规范生成智能体评测集 — omarsar0 · 2026-08-30
- Cursor 示范「握住 harness 与模型」的公司护城河 — omarsar0 · 2026-08-30
- PenEcho Agent 集成 DeepSeek,实现画布视觉交互 — Civil-Direction-6981 · 2026-08-30
- 实测吐槽:ChatGPT 编写 ComfyUI 工作流体验极差 — caglar_ee · 2026-08-30
- Navan 工程师:智能体现状犹如 2015 年的微服务 — AI Engineer · 2026-08-30