Neocloud 加推理、推理商囤 GPU:AI 公司争夺的是 token 流向控制权
AccBalanced · x · 2026-09-28
jessiedong 观察到 AI 产业链正互相渗透:neocloud 开始做推理服务,推理公司自购或预留 GPU,连 OpenRouter、Vercel AI Gateway 这类路由也需保障 GPU 容量。
她认为表层动机是赚钱,深层逻辑是控制 token 流向,而这要求控制 GPU 供给:
- neocloud:加推理是为了最大化 GPU 使用率
- 推理公司:自备算力避免受制于 AWS 或云厂商,保证服务独立性
- 路由器:必须有足够可用 GPU,否则请求无处可发
结论:算力供给越紧张,这种垂直整合趋势越会加速。
「Infra」频道最新
- FailureAtlas 论文:多厂商 LLM 网关最致命的故障是静默返回 HTTP 200 — its_vayishu · 2026-09-28
- 二手 RTX 3090 涨到近 1500 美元,买家直呼像 GPU 抢椅子游戏 — sleight42 · 2026-09-28
- Strix Halo 跑 Qwen 3.8 Flash Next:换 gufo 推理,预处理速度翻倍于 llama.cpp 分支 — fallingdowndizzyvr · 2026-09-28
- 爬虫服务 p50 稳定 2 秒,作者强调应用与数据库必须同区部署 — DanielLockyer · 2026-09-28
- 北大开源 RayOrch:数据准备管线最高提速 15.14 倍 — PekingUniversity · 2026-09-28
- 算力生意里为什么信用质量最关键:集群不透明,只能盯出钱的人 — AccBalanced · 2026-09-28