SemiAnalysis 认为推理时代内存和存储比更快 GPU 更关键
rwang07 · x · 2026-07-27
Dylan Patel 的观点是:推理时代不再是“只买最新 GPU 就赢”。在一些工作负载里,哪怕 GPU 本身更弱,只要存储和内存配置更好,也可能跑赢更快的芯片。
转述里还提到,SemiAnalysis 已经在 超过 8000 万美元 的算力上做持续基准测试,覆盖 Nvidia GPU、AMD GPU、Google TPU 和 Amazon Trainium,并且每天用最新推理引擎、驱动、PyTorch 版本和一批中文模型(GLM、Zhipu、Moonshot、Kimi、阿里系模型)自动跑测试。
另一个观点是,Nvidia 通过给 100+ 家 neo-cloud 分配芯片、提供贷款兜底等方式影响生态,并借这些云厂商扩大自己的话语权。整体信息指向:内存、存储和渠道控制,正在和单纯的算力峰值一样重要。
「Infra」频道最新
- 开源剖析器可追踪语音 Agent 每次 STT、LLM、TTS 调用 — mahimairaja · 2026-07-27
- llama.cpp 合入 GLM-5.2-Vision 本地多模态支持 — QuixiAI · 2026-07-27
- 自建 LLM 服务器让作者意识到,自托管最难的是可靠性 — MaxChamp08 · 2026-07-27
- 便宜存储让 SCD Type 2 显得过时,作者主张改用每日快照 — Zachly · 2026-07-27
- HuggingHack 增加 S3、MinIO、Ollama 和 vLLM 调度 — TyedalWaves · 2026-07-27
- Copilot 变免费后,他在想要不要卖掉双卡 AI 主机 — tweetibird · 2026-07-27