Bespoke Labs 后训练让大模型变身代码仓库专家
Bespoke Labs(Dimitris Dimakis 团队)与 Thinking Machines(John Schulman 团队提供支持)合作发布新研究,探索如何把模型后训练成针对特定 GitHub 仓库的编码专家。方法基于 Inkling 基座模型,结合 SFT 与 GRPO 进行后训练,结果显示模型在该代码仓库上的性能提升了 57 个百分点。
2026-09-04 ~ 2026-09-04 · 2 条相关
- Bespoke Labs 用 SFT+GRPO 后训练,代码仓库性能提升 57pp — AlexGDimakis · 2026-09-04
另有 1 条近重复转述:AlexGDimakis