GPT-4 级推理价格 45 个月暴跌 60 倍,但地板价开始回升
rohanpaul_ai · x · 2026-09-17
Rohan Paul 总结当前 LLM 推理成本的关键转折:
- 成本崩塌:GPT-4 级推理从每百万 token 20 美元降至约 0.33 美元,45 个月内下降约 60 倍,速度远超历史上 PC 算力和互联网带宽的成本下降曲线
- 地板不再只往下走:DeepSeek 将 V4-Pro 输出价格上调 2.3 至 4.6 倍
- Kimi K3 的标价陷阱:K3 表面上便宜,但因单任务消耗 token 更重,相对 GPT-5.6 Sol 的实际折扣只剩约 30%——按每完成任务的成本算而非每 token 算,便宜幅度会大打折扣
另引用 Mozilla 一份 91 页报告:开放权重模型已落后前沿仅约 4 个月;8 月 OpenRouter 按用量计前 10 模型中 8 个是开放权重、7 个中国造,DeepSeek 成为首个在周请求量登顶的开放模型。但经济账并不对称:开放模型承担约 20% 的用量,却……(原推后续被截断)。
「Infra」频道最新
- 孟菲斯大学研究:xAI Colossus 1 运营一年周边空气未见明显恶化 — TinfoilTricorn · 2026-09-17
- Beam 上线半年即每 30 分钟处理约 1TB 带宽流量 — markjeffrey · 2026-09-17
- VC-Attention 免训练低比特注意力:B200 上提速 1.6 倍,超越 FlashAttention-4 — xiuyu_l · 2026-09-17
- mlx.fast 修复计速 bug:MLX 实测 80.6 tps,接近翻倍目标 — HankYeomans · 2026-09-17
- IBM NorthPole 芯片宣称推理性能达 NVIDIA 方案 22 倍 — Site-Staff · 2026-09-17
- 内存荒打到结账页:小米等手机涨价 200-1000 元 — tengyanAI · 2026-09-17