R-Quest 论文:用问题有效性与新颖性反馈终结自进化模型的性能崩塌

HINT-lab · hf · 2026-10-08

HINT-lab 论文研究推理模型自进化(用自生成问题自我训练)为何多轮后性能崩塌:

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →