Tokenomics 101:从三种种计费方式看 AI 时代的 token 经济账
Aizkmusic · x · 2026-09-02
博主为自己的《Tokenomics 101》一文引流(承接此前 Fable 5.1 实测中提到的天价 token 账单)。文章要点:
- 世界对 token 的渴求呈爆炸式增长:几年前几千 token 上下文是标准,如今开源模型也普遍百万级;agent 可连续运行数小时甚至数天,还能自生子 agent——引用 Jarred Sumner 用 Rust 重写 Bun 时峰值同时跑约 64 个 Claude 的例子。
- 主流厂商基本按三种方式计价:输入 token、输出 token、缓存 token。缓存 token 指请求命中近期处理过相同 prompt 的服务器,可节省大量算力与时间;LLM 对话回合制的天然特性使其非常适合缓存,如今大多已在后台自动处理。
「模型」频道最新
- WSJ:Gemini 3.8 Flash 明日发布,内部编码测试优于 Opus — kimmonismus · 2026-09-02
- Fable 5.1 零推理模式完美解决阅读理解题 — Sauers_ · 2026-09-02
- 用户实测 Fable 5.1 半小时耗尽 Claude 5 小时额度 — robleclerc · 2026-09-02
- Replit 发布 Atlas:多功能自回归多模态模型 — gowthami_s · 2026-09-02
- Astra 模型引关注,测试效果被看好 — inductionheads · 2026-09-02
- CursorBench 榜单更新:Grok 4.6 与 Fable 5.1 领跑 — GavinSBaker · 2026-09-02