实测:中国编码模型 token 消耗达 2-3 倍,便宜不等于省钱
craigbalding · x · 2026-09-18
作者根据编码基准观察,中国开源模型在编码任务中 token 消耗通常是其他模型的 2-3 倍——单 token 更快更便宜不代表总成本更低。它们在终端基准上确实更强、首 token 延迟可以很快,但是「token 酒鬼」。一些供应商提供错峰折扣价(如 BitDeer),可把成本砍半使其具备竞争力。作者提醒基准不可尽信,应按自己的工作负载实测,目前尚无充分理由切换。
「编程与Agent」频道最新
- Agent 项目烂尾后还剩什么:隐性知识散落在提示词与配置里 — Mariav_Dowdf · 2026-09-18
- PCP 草案:给 AI Agent 立规矩的「有边界的授权协议」 — sierracatalina · 2026-09-18
- Legatus v0.1 开源:面向委派工作的传输无关协调协议 — sierracatalina · 2026-09-18
- Salesforce 推出 Trusted Enterprise AI Harness,统一 agent 上下文与安全治理 — emmanuelvivier · 2026-09-18
- microvm+gVisor 沙箱跑 codex/claude,agent 拥 root 仍安全可控 — craigbalding · 2026-09-18
- LLM 评测复现工具 EvalSeal:LLM 裁判 20 例中 5 例翻转 — Fit_Fortune953 · 2026-09-18