Relace推出Compact模型,5秒极速压缩Agent上下文降本提速
针对长会话中Agent上下文膨胀导致的缓存失效与开销激增问题,Relace推出了专为上下文压缩设计的Relace Compact模型。该模型在长会话自动压缩中仅需5秒,远快于原生方案,并能在缓存失效时将Token成本大幅降低50%以上,显著提升了工程效率。
2026-07-14 ~ 2026-07-15 · 3 条相关
- Agent上下文压缩可降半数成本 — appenz · 2026-07-14
- Relace Compact:极速Agent上下文压缩模型 — stuffyokodraws · 2026-07-15
- 长会话上下文压缩提速 — dee_hw · 2026-07-15