Relace推出Compact模型,5秒极速压缩Agent上下文降本提速

针对长会话中Agent上下文膨胀导致的缓存失效与开销激增问题,Relace推出了专为上下文压缩设计的Relace Compact模型。该模型在长会话自动压缩中仅需5秒,远快于原生方案,并能在缓存失效时将Token成本大幅降低50%以上,显著提升了工程效率。

2026-07-14 ~ 2026-07-15 · 3 条相关