SkillGym fine-tuning lifts Qwen3.5 35B past Claude Sonnet 4.6 on agentic coding benchmarks

dair_ai · x · 2026-09-28

dair-ai highlights a paper exploring continual training of specialized models on skills via SkillGym:

Original post →

More from coding & agent

coding & agent channel →