4B 模型靠在线合成课程达 61.5% SWE-bench,不需蒸馏前沿模型

rohanpaul_ai · x · 2026-09-21

FrogNano 项目从 Qwen3.5-4B 出发,通过强化学习在约 1500 个合成软件工程任务上训练出一个 4B 编码 agent,在 SWE-bench Verified 上达到 61.5%,且未经前沿模型蒸馏。关键在于两点:

论文:arxiv.org/abs/2609.07925

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →