Intel 高管:Uber 数月烧完一年 AI token 预算,80% 负载可用低价 open-rate token
ryanshrout · x · 2026-09-26
Intel AI 数据中心副总裁 Anil Nanduri 在访谈中透露,Uber 在几个月内就烧穿了原定一年的 AI token 预算,并认为这种超支正在成为企业 AI 支出的常态。
- Nanduri 估计,约 80% 的企业工作负载其实可以运行在更便宜的 open-rate token(开放费率)上
- 但目前很少有企业按这种方式定价采购
对企业 AI 成本结构有直接参考意义:token 消耗增速远超预算规划,而计费模式的错配可能造成大量浪费。
「Infra」频道最新
- AMD 发布 Helios GPU 教学版 GEMM 优化阶梯:从基线到峰值性能 — salykova_ · 2026-09-26
- Terafab 启动招聘:目标年产 1TW 芯片,剑指轨道 AI 算力 — seanmcdonaldxyz · 2026-09-26
- LLM 推理扩容博客链接:从单节点优化到百万级规模 — abhijithneil · 2026-09-26
- 从单节点到百万节点:作者分享 LLM 推理扩容实践博客 — abhijithneil · 2026-09-26
- 三星联合牛津北大推出 TrOPD,让端侧小模型继承大模型推理 — jiqizhixin · 2026-09-26
- LLM API 该按量付费还是承诺用量?真实采购决策的三个问题 — LeviYagami · 2026-09-26