FrogNano:4B 纯 RL 训练模型拿下 SWE-bench 61.5%

sivareddyg · x · 2026-09-09

FrogNano 基于 Qwen3.5-4B,完全不用蒸馏、零教师轨迹 SFT,仅靠 TaskPilot 合成任务做纯强化学习后训练:5 次迭代 × 300 个任务,SWE-bench Verified 达 61.5%。

所属事件:FrogNano 4B 模型纯 RL 训练拿下 SWE-bench 61.5%(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →