清华与贝壳提出 DRIFT 框架:突破大模型在线自进化瓶颈

青稞AI · wechat · 2026-07-26

清华大学、贝壳及巴黎高师的研究团队提出了一种名为 DRIFT 的大模型在线自进化后训练框架,旨在解决 RL 之后模型如何持续进化且不崩溃的难题。

该框架的核心机制包括:

实验表明,DRIFT 能在无外部专家监督的情况下实现模型的自我纠错与持续进化,并在多个复杂推理和工具使用(Tool Use)基准上取得新的 SOTA。原作者将于近期举办线上分享会,深度解析该算法的设计动机与理论思考。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →