AI 推理需求再暴涨,供给端又被需求「教做人」
Baconbrix · x · 2026-09-01
一条调侃推文配上本月 token 用量增长数据图,指出 AI 推理需求持续暴涨、供给端再次跟不上需求。原帖未展开具体数字细节,但「又一个正常的 token 增长月」的配图暗示增长幅度可观。
「Infra」频道最新
- Qwen3.8 Flash 在双 DGX 上跑出 415 tok/s — NVIDIAAI · 2026-09-01
- 曝 OpenAI 自研芯片 Jalapeno:LLM 推理速度达 1500 tokens/s — firstadopter · 2026-09-01
- TensorSharp 跑 Qwen 3.8 Flash Next 性能实测 — fuzhongkai · 2026-09-01
- 腾讯混元 AngelSlim:Hy4 模型压缩至 214GB 并支持异构协同 — 腾讯混元 · 2026-09-01
- 三星为英伟达改推8层HBM4E,速率要求提高20% — 创业邦 · 2026-09-01
- 为何 Llama.cpp 中增大上下文反而提升了推理速度? — satnl · 2026-09-01