Paradigm 揭秘后训练关键:程序生成+LLM 出题的互补合成数据组合

tensorqt · x · 2026-10-07

Paradigm 分享其数学模型后训练经验:提升高度依赖组合两种互补的合成数据生成机制——

两者结合才在后训练中获得显著收益,单独使用任一种效果有限。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →