2.6 万美元双 RTX 5090 工作站主打本地跑前沿模型
dee_hw · x · 2026-08-11
推主分享了一款名为 Autonomous Computer 的双 GPU AI 工作站,起售价为 26,100 美元。该设备主打本地运行前沿模型(如 DeepSeek V4 Flash),宣称能提供高达 300 tok/s 的速度,让用户彻底摆脱云端 API 的按量计费与隐私担忧。
硬件配置方面,基础款搭载两块 RTX 5090 显卡,提供 64GB 显存和 210 TFLOPS 的 FP32 算力,并支持扩展至 RTX PRO 6000 Blackwell 以获得更高性能。整机采用 CNC 切割铝合金外壳,配备双 PCIe 5.0 x16 riser 和 2000W 电源。官方强调,本地部署意味着模型权重完全由用户掌控,数据隐私受“物理隔离”保护,且支持基于私有数据进行微调。
「Infra」频道最新
- Ling-3.0-flash 量化实测:MoE 架构让解码速度几乎无损 — AcanthisittaOk1699 · 2026-08-12
- NVIDIA 路由库实测:编码智能体成本降 59%、耗时减 32% — sudoraohacker · 2026-08-12
- SD视频生成优化实测:CK加速使耗时大降,但提示词遵循变差 — switch2stock · 2026-08-12
- M4 Max 浏览器跑 30B 模型达 25 tok/s,自定义 WebGPU 内核立功 — xenovatech · 2026-08-12
- 开发者询问OpenAI:能否用自家地下室GPU运行ML实验? — daniel_mac8 · 2026-08-12
- LMSYS发布统一Radix缓存:混合模型前缀缓存新方案 — ying11231 · 2026-08-12