实测:中国编码模型 token 消耗达 2-3 倍,便宜不等于省钱

craigbalding · x · 2026-09-18

作者根据编码基准观察,中国开源模型在编码任务中 token 消耗通常是其他模型的 2-3 倍——单 token 更快更便宜不代表总成本更低。它们在终端基准上确实更强、首 token 延迟可以很快,但是「token 酒鬼」。一些供应商提供错峰折扣价(如 BitDeer),可把成本砍半使其具备竞争力。作者提醒基准不可尽信,应按自己的工作负载实测,目前尚无充分理由切换。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →