Agent 的隐性成本在 KV cache:DeepSeek 压到每 token 约 890 字节
altryne · x · 2026-09-12
Chris Alexiuk 指出 agent 运行成本的秘密在于 KV cache:账单大头取决于缓存命中还是未命中,而非算力本身。
DeepSeek 走的压缩路线将 KV cache 压到每 token 约 890 字节,让更多上下文保持"热"状态而不会烧掉 GPU,是控制长上下文 agent 推理成本的关键路径。
「编程与Agent」频道最新
- DeepSeek V4-Pro-0813 与 GLM-5.3 上线 Nebius,主打编码与 Agent 工作流 — Arindam_1729 · 2026-09-12
- Brex CEO:PRD 已死,公司该给 AI 员工配岗位与预算 — petergyang · 2026-09-12
- 三次独立测试两次显著更差:换便宜模型你可能只是运气好 — Ok-Challenge-7810 · 2026-09-12
- 开源工具 bough 把 Codex/Claude Code 会话历史画成可视化地图 — VoidEqualZero · 2026-09-12
- GPT-6 Astra 搭建开源 AI 软件工厂:7×24 无人值守从需求到上线 — Cole Medin · 2026-09-12
- OpenClaw 用户福音:本地/远程网关连接应用实测好用 — steipete · 2026-09-12