Kimi K3 撬动全球AI定价,中美算力成本差异引争议

近期,月之暗面的 Kimi K3 模型引发了 AI 社区的广泛关注。该模型以极低的使用成本切入高性能市场,不仅直接挑战了现有西方模型服务商的定价体系,更暴露出中美两国在算力获取与基础设施成本上的系统性差异。

定价对比与市场冲击

@beffjezos 直接对比了 Kimi K3 与 Fable 5 的使用成本,给出的数字分别是 $16.45 和 $37.94。这种巨大的价格差被形容为“你的利润就是我的机会”。@heyshrutimishra 的转发也指出,Kimi K3 在编程基准上可对标 Claude Fable 5,但输出 token 价格约为每百万 $15,中国前沿模型正在快速压缩全球 AI 的定价曲线。

中美算力成本争议

围绕 Kimi K3 的成本悖论,前 Stability AI 联合创始人 Emad Mostaque 提出,Modal、Fireworks 和 Baseten 等美国云平台由于能不受限制地获取先进的 Nvidia 和 AMD 芯片,部署该模型的推理服务成本可能做到中国竞争对手的十分之一。然而,这一“十分之一”的判断遭到 @koltregaskes 转发时的质疑,他认为更现实的差距大约是便宜 2 到 5 倍。此外,@AccBalanced 提到,在 DeepSeek 这类中国托管、且缓存读占比较高的场景里,成本可能明显更低,这也让 OpenRouter 等平台的定价合理性受到追问。

基础设施优化预期

针对当前推理成本偏高的问题,Emad Mostaque 强调这并非模型存在不可逾越的技术上限,而是支撑基础设施还不成熟。他预计,随着专门的推理服务商在 kernel、路由、量化、批处理、内存和 serving 等环节的持续优化,未来几个月内 Kimi K3 的推理成本有望下降 10 到 50 倍。

2026-07-19 ~ 2026-07-21 · 9 条相关