仅 500 个 SWE 任务微调,AfterQuery 让 Qwen 27B 提升 11.3 分
ycombinator · x · 2026-10-09
AfterQuery 团队宣布,仅用其 SWE agent 数据集中的 500 个任务做后训练,在 15 步 GRPO 内就让 Qwen3.8-27B-Medium 提升了 11.3 个点。团队强调"并非所有编码数据生而平等",高质量任务筛选的收益远超数据量堆砌,详细训练实验写在博客里。
所属事件:仅 500 个任务微调,AfterQuery 让 Qwen 27B 提升 11.3 分(2 条相关)→
「研究」频道最新
- Yacine 呼吁打造代码复用评测基准,用 hill climbing 优化模型 — yacinelearning · 2026-10-09
- 数据公司转型做研究:验证器设计成最可攀爬的方向 — madhavsinghal_ · 2026-10-09
- Amazon 复盘 Karpathy AutoResearch:生产级跑了 12 周,暴露 5 类失败模式 — amazon · 2026-10-09
- ReGain:免训练修复合成图个性化,弥合 51-64% 主体保真差距 — UIUC-CS · 2026-10-09
- Agent Plasticity 论文:前沿模型自我改进效率差异悬殊,迁移常不完整 — _akhaliq · 2026-10-09
- Iris-3B 开源:绕开 VAE 的像素空间扩散文生图模型,Apache 2.0 全开放 — _akhaliq · 2026-10-09