Scaling01 论 LLM 定价:成本线性缩放,利润率决定价格
scaling01 · x · 2026-08-31
针对 LLM 定价模型的讨论,作者反驳了对方的观点,认为在当前前沿模型范围内,线性定价模型是一个有用的近似值。核心论据包括:
- 成本与参数:成本主要取决于活跃参数,约占总参数的 3%-5%,且与总参数呈线性关系。
- 缩放假设:缩放定律对最大的前沿模型(算力受限)比小模型更准确。
- 定价权与利润率:最终价格是成本加成。前沿模型因竞争力强拥有高利润率,而大多数开源模型缺乏定价权,利润率随尺寸增加而递减(少数如 Kimi-K3 和 GLM-5.3 例外)。
作者认为,列出那些没有定价权、架构各异的开源模型来反驳这一点是无效的。
「Infra」频道最新
- Nvidia 宣布 SpaceX 将部署 Vera CPU 加速 agentic AI,Grok 采用 Vera Rubin — Beth_Kindig · 2026-08-31
- 实测 OpenAI 多 agent 协作:日耗 37 亿 token 效率分析 — rudrank · 2026-08-31
- SK Hynix 印州 HBM 工厂动工,HBM4e 预计 2029 年量产 — Beth_Kindig · 2026-08-31
- Qwen 3.8 Flash Next 实测:中端手机跑出 3.5 tok/s — dai_app · 2026-08-31
- Boring Company 招商困局:20倍成本优势却缺销售团队 — PTrubey · 2026-08-31
- 硬核实战:4080 显卡运行 182B Qwen 模型达 8 tok/s — Desperate-Data-3747 · 2026-08-31