Kimi 需求暴涨:便宜AI反而拉高算力
vaibhavbetter · x · 2026-07-20
Wall Street 里那种“便宜的中国模型会杀死 NVIDIA”的叙事,被 Kimi 的现状直接反转了:
- 48 小时内订阅被暂停,原因是 GPU 已经打满
- 团队正在尽可能快地扩容
- 作者把这称为“Jevons 悖论 + CUDA 账单”
核心观点是:更便宜的智能未必降低算力需求,反而可能把需求彻底点燃,最终带来更大的推理与训练算力开销。
「Infra」频道最新
- 开源 SmolVM:2026 年 Agent 不止用浏览器,而是拥有整台电脑 — aniketmaurya · 2026-09-11
- PyTorch Day Korea 2026 首届线下大会启动,9月13日截止征集演讲 — PyTorch · 2026-09-11
- 本地跑 LLM 选卡:4 张 CMP-170HX 涨价 vs Mac Studio M5 — rumboll · 2026-09-11
- llama.cpp 为 RDNA4 调优 Flash Attention,大上下文提升明显 — pmttyji · 2026-09-11
- p99 延迟基准可能在骗你:一篇长文讲透 coordinated omission — Franc0Fernand0 · 2026-09-11
- 12GB 显卡跑 MiniMax H3:量化格式、加速 LoRA 与注意力方案怎么选 — Possible_Mood676 · 2026-09-11