阿里披露 Qwen 已连续跑 RSI 一个多月,Qwen 4.0 全系深度自进化
teortaxesTex · x · 2026-10-11
云栖大会上,Qwen 负责人刘大一恒披露:阿里内部已实际使用 RSI(递归自我改进),且早在 Qwen 3.8 Max 就已连续运行超过一个月,Qwen 4.0 全系(Max/Plus/Flash/27B)将继续深度采用。
其流程为:模型从真实日志自动找短板→自造训练数据→小模型多轮验证→最终推入旗舰训练,全程近乎零人工干预。据称连续运行一个多月、完成 33 轮有效迭代,Qwen3.8-Max 的 AA 智能指数在 30 天内从 40 涨到 45,冲上第一梯队。
不过发帖人 teortaxesTex 对此持保留态度,评论称「yeah… after a manner…」,暗示宣传口径与实际效果之间可能有水分。
「模型」频道最新
- 前 OpenAI 安全高管吐槽:Claude iOS 伪通知关不掉 — Miles_Brundage · 2026-10-11
- Google EmbeddingGemma 2 免费本地跑,Mac 即可体验 — Saboo_Shubham_ · 2026-10-11
- 用户吐槽 Google AI Mode 搜索仍会幻觉,称一年多未见 AI 翻车 — burny_tech · 2026-10-11
- 跑个任务 Claude 直接烧掉 17 美元,用户直呼钱包顶不住 — lxfater · 2026-10-11
- 自费用户的 AI 算账法:单任务成本才是唯一值得关注的指标 — victor_explore · 2026-10-11
- 数学家逐条核查:OpenAI 的 Navier-Stokes 证明在 Lean 中无误 — burny_tech · 2026-10-11