开源模型使用量无法精确统计,推理商 token 数成最佳估算依据

xeophon · x · 2026-09-20

在关于开源模型实际使用量的争论中,xeophon 反驳 OpenRouter 数据可作为基准的说法,指出开源本质上是去中心化系统,永远无法精确测量其使用量。他给出的最佳估算法是:估算大型闭源实验室的算力规模,再推断其余部分有多少跑开源模型。他同时提到 HF 下载量快速增长,Together、Baseten、Fireworks 等推理服务商的 token 消耗也在快速上升。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →