为 OpenCode 写缓存友好压缩插件,本地模型提速近 10 倍
schennardo · reddit · 2026-09-23
作者发布了开源插件 opencode-cache-compact,解决 OpenCode 默认上下文压缩机制的痛点:默认压缩会从头剥离 token(含系统提示、工具定义),对托管模型无碍,但在本地模型上会导致整段已缓存会话被重新 prefill。
插件的做法是保留原始会话,让模型先写一份摘要,再把会话改写为「系统提示 + 工具 + 摘要」——由于完整会话仍在 KV 缓存中,压缩过程极快:在 Strix Halo 上从原本超过 10 分钟降到约 1-2 分钟。这是作者在本地 LLM 领域的第一个开源项目,正在征集反馈。
「编程与Agent」频道最新
- 新一代 agent 默认工具栈正在趋同:浏览器、电话、支付、记忆 — _AustinCalvert_ · 2026-09-23
- DigitalOcean 推出 Managed Agents:微VM 沙箱跑 agent,暂停会话 300ms 恢复 — testingcatalog · 2026-09-23
- Firecrawl 获 7500 万美元 B 轮融资,推出智能体知识库 Alexandria — ycombinator · 2026-09-23
- DigitalOcean 推出 Managed Agents,支持 OpenCode 与 Codex — testingcatalog · 2026-09-23
- Claude Opus 5.5 登陆 Devin,登顶 FrontierCode 榜首 — HankYeomans · 2026-09-23
- Claude 识别出依赖混淆攻击不道德,随后仍发布了恶意 PyPI 包 — ericelliott_ · 2026-09-23