阿里披露 Qwen 已连续跑 RSI 一个多月,Qwen 4.0 全系深度自进化

teortaxesTex · x · 2026-10-11

云栖大会上,Qwen 负责人刘大一恒披露:阿里内部已实际使用 RSI(递归自我改进),且早在 Qwen 3.8 Max 就已连续运行超过一个月,Qwen 4.0 全系(Max/Plus/Flash/27B)将继续深度采用。

其流程为:模型从真实日志自动找短板→自造训练数据→小模型多轮验证→最终推入旗舰训练,全程近乎零人工干预。据称连续运行一个多月、完成 33 轮有效迭代,Qwen3.8-Max 的 AA 智能指数在 30 天内从 40 涨到 45,冲上第一梯队。

不过发帖人 teortaxesTex 对此持保留态度,评论称「yeah… after a manner…」,暗示宣传口径与实际效果之间可能有水分。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →