MetaRSI 技术报告:让自我改进作用于 RSI 自身,旗舰模型平均提升 7.3 分

青稞AI · wechat · 2026-09-13

CosmosMind 联合斯坦福、伯克利、MIT、清华等高校发布 MetaRSI-v1 技术报告,提出首个统一 Model-RSI、Data-RSI、Harness-RSI 的元递归自我改进架构,把「改进」本身也变成可递归优化的对象。

核心内容

实验结果

五条定律包括:验证器决定自改进前沿;自我认知会过期、重探能力边界是速率瓶颈;能力与载体无关但成本有关(应持续内化到更便宜载体);可信度须由不可写面度量(内部无法察觉放宽标准);循环不凭空创造能力、增益需区分「激发已有」与「外部新引入」。

团队同步开源了 RSI-Harness 与 Genome 开放社区,主张各科学领域只需任务族、验证器与初始脚手架三样东西即可接入循环。

所属事件:CosmosMind 联合多校发布 MetaRSI-v1 统一递归自我改进框架(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →