Token 原生存储方案:号称拿到 3.3 到 6 倍压缩和更低延迟
ojasvi_yadav · x · 2026-07-24
- 这条帖提出一个基础设施观点:Agent 不是按人类可读文本来“读”数据,而是按 token 读取,所以搜索/数据库系统应从 UTF-8 文本存储转向 token-native。
- 作者声称,直接存原始 token id 就能获得 1.5–2.5 倍 的“免费压缩”。
- 再叠加 token id 压缩后,总压缩率可达到约 3.3–6 倍,明显优于 zstd 和 lz4。
- 引用的博客还给出了面向 LLM 与面向人类文本的 延迟与压缩基准测试。
「Infra」频道最新
- 语音 Agent 选 STT,先看可用转写速度而非 WER — Top_Conclusion5327 · 2026-07-24
- 做 agent 的创业者追问:上线前最该拦住哪类故障 — marcin_michalak · 2026-07-24
- AI 数据中心热潮被指在重演次贷式经济逻辑 — benwen · 2026-07-24
- NVIDIA 与 KAIST 共建韩国首个高校联合 AI 实验室 — NVIDIA Blog · 2026-07-24
- 家里跑算力、Azure 放状态:共享 Postgres 的多智能体架构 — MRobinsonTX · 2026-07-24
- Synopsys CEO 称 AI 芯片设计已到 L4,前端用上 6 到 8 个智能体 — Scobleizer · 2026-07-24