跨模型 Token 比较无意义,推理时代指标更需细分
adamdangelo · x · 2026-08-27
Adam D'Angelo 指出,将不同模型的 Token 数量合并比较是毫无意义的,因为 Token 无法在模型间进行等效对比。随着模型多样化以及推理过程在总 Token 中占比越来越高,这一问题变得愈发明显。
「模型」频道最新
- Gemini 3.5 Transcribe 上线,Enterprise Agent Platform 公测 — Saboo_Shubham_ · 2026-08-27
- Qwen3.8 27B 量化评测:4-bit 表现稳健,1-bit 崩溃 — pmigdal · 2026-08-27
- GLM-5.3-Flash 评测:成本仅大模型 10%,登顶性价比 frontier — ArtificialAnlys · 2026-08-27
- Google 公布 Gemini 3.7 Flash 定价详情 — OfficialLoganK · 2026-08-27
- Unsloth 推出 GLM-5.3-Flash GGUF 量化版 — unsloth · 2026-08-27
- N-Gram 表格技术能否改变本地大模型格局? — AcreMakeover · 2026-08-27