微软论文:蒸馏 50 条轨迹写成技能卡,小模型追平推理模式

rohanpaul_ai · x · 2026-09-07

微软新论文探索「推理成本只付一次」:用少量从历史 agent 运行中学到的规则,替代昂贵的测试时推理。

方法

结果

边界

实践结论:把重复流程蒸馏成技能,把昂贵的测试时推理留给真正需要即时搜索的任务。

所属事件:微软论文:蒸馏技能卡可省数倍token(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →