自托管 GLM-5.3 搭 DeepSeek Harness 实测缓存命中率 99.7%
burny_tech · x · 2026-09-21
Ahmad Osman 分享:用 DeepSeek Harness 配合自托管的 GLM-5.3,拿到了 99.7% 的 prompt cache 命中率,可大幅降低推理成本。他强调这一差距源于「精心工程化的 harness」与 vibe coding 产物之间的区别——上下文组织方式直接决定 KV/prefix 缓存能否命中。
「编程与Agent」频道最新
- AI 两小时做出完整 MMO,资深程序员追问:技能不再被需要怎么办 — devontec · 2026-09-21
- 向智能体下指令新姿势:用 ChatGPT 听写口述需求再粘贴 — athyuttamre · 2026-09-21
- 换用 Jesse 智能体零成本击败我的世界末影龙,仅 7 分 6 秒 — BLUECOW009 · 2026-09-21
- 开发者花 3 天逆向 Instinct 记忆系统,60 行代码复刻同款 — iamrobotbear · 2026-09-21
- Code Contracts 开放格式:用注释给代码写下 Agent 可执行的契约 — aronchick · 2026-09-21
- 用户怒批 OpenAI Codex 重置机制:付费却不知限额何时恢复 — StewartalsopIII · 2026-09-21