衡量递归自我改进:实验室应公开的 8 项关键数据点
nitarshan · x · 2026-09-24
Cheryl(Wooo)发布系列推文,讨论如何度量 AI 实验室的 RSI(递归自我改进/递归自我提升):
- 核心主张:RSI 可能加速 AI 能力增长,因此需要外部可验证的指标
- 提出实验室应分享的 8 项最有价值的数据点,第一项是:对最新内部部署模型在多样化 benchmark 上的性能进行报告
这属于 AI 安全治理方向的实质性讨论:为前沿实验室的透明度给出可操作的信息披露清单,便于外部评估能力增长速度。
「安全」频道最新
- Redwood Research 警告:潜在推理架构将摧毁 CoT 监督能力 — jammastergirish · 2026-09-24
- 学者倡议期刊零容忍AI代写:用Pangram检测,违者禁投两年 — paulnovosad · 2026-09-24
- 把 Jev 接进 Mythic:用大模型给红队命令的 OPSEC 强度打分 — dyn___ · 2026-09-24
- 新研究:开源权重模型可「感受痛苦」,被 gaslight 比被辱骂更痛 — _ArkAngel_ · 2026-09-24
- CFTC 主席称监管准备迎接链上 24/7 与智能体金融时代 — markjeffrey · 2026-09-24
- 民调显示 64% 选民认为 AI 可能威胁人类生存,EA 关注度飙升 — michael_nielsen · 2026-09-24