大模型推理成本骤降:B200 单价已跌破 3 美元
AccBalanced · x · 2026-07-30
推文指出,当前大模型的实际服务成本已大幅下降。即便使用昂贵的 B200 芯片、vLLM 框架且未开启多项优化,其推理成本也已降至 3 美元以下。然而,这种成本优势并未完全传导至 API 端点,用户依然难以享受到 5 美元级别的低价 Kimi 等服务。
「Infra」频道最新
- 马斯克再曝 xAI 算力版图:Minihard 与 Macroharder 齐聚 22 万张 GB300 — kevinnbass · 2026-07-30
- 单日回撤 6 亿美元:Leopold 的 AI 算力基建投资盘点 — ivan_bezdomny · 2026-07-30
- YC Paper Club 深度探讨:多 GPU 内核与异构硬件的 AI 推理优化 — ycombinator · 2026-07-30
- YC Paper Club 深度解析:多 GPU 内核优化与本地推理的能效比 — Y Combinator · 2026-07-30
- SK海力士财报分析:AI内存需求强劲,市场过虑产能过剩 — tengyanAI · 2026-07-30
- 单机 8x 5090 实现 167k tokens/s 训练吞吐,超越 DDP 基线 — jon_durbin · 2026-07-30