Salesforce研究:让弱模型模仿强模型反降15%,纠错式微调才有效

rohanpaul_ai · x · 2026-09-22

Salesforce AI 研究发现:当 agent 的提示词、工具和工作流已围绕较弱的 Qwen3-Coder-30B-A3B 调优后,直接用强模型(Gemini)的完整轨迹去微调弱模型,反而会破坏原有表现。

结论:微调模型时,不要破坏已经围绕它正常工作的 agent 设置。

所属事件:Salesforce 研究:模仿强模型轨迹微调反使 agent 性能下降(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →