字节推SWE-Pruner Pro让编码智能体自剪上下文

字节跳动及合作者提出了面向编码智能体的上下文裁剪方法 SWE-Pruner Pro。该方法发现,大模型自身的内部表征已包含足够信号,可直接判断工具输出该保留还是删除,无需外挂独立剪枝模型。实验表明,该方法能为编码智能体节省 39% 的 token 消耗,同时保持性能不掉点,有效提升了智能体的运行效率。

2026-07-21 ~ 2026-07-22 · 3 条相关