Distil 用统计检验给智能体上下文压缩上了质量门禁

chandu1221 · reddit · 2026-07-26

Distil:给智能体做“有质量约束”的上下文压缩

这个项目做的是 LLM 智能体上下文压缩,但它不主张“压短了就算成功”,而是把压缩配置放到真实 agent 轨迹上做 配对非劣检验(TOST / McNemar)。作者的原则很明确:只要某种压缩会改变 agent 的工具调用或输出决策,就在发布前直接拒绝。

要点包括:

作者还解释了为什么要做这个门控:早期版本过度摘要旧消息,单轮 token 看起来省了很多,但一跑真实 harness,端到端成功率就崩了。另一个教训是,改写对话前部会破坏 prefix cache,所以 Distil 采用“前缀保持字节稳定、尾部再压缩”的策略。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →