Weco 八天自改进实验引 RSI 争论:收益递减还是威胁临近?
emax · x · 2026-09-27
emax 转发 Machine Learning Street Talk 最新播客(43 分钟,嘉宾为 Weco 联合创始人 Zhengyao Jiang),并评论称「指数级递归自我改进的生存风险」是在为一件大概率不会发生的事制造恐慌,因为新兴研究表明 RSI 会遭遇递归式收益递减。
播客核心内容:
- Weco 让一个 AI 编码 agent 在底层模型不变的情况下,连续八天重写另一个 agent 的 harness(代码、提示词与工具),即 AIDE 85 实验;
- 讨论其声称的「超过两年人类工程」的收益究竟证明了什么,held-out 评测如何设计,以及如何区分有用发现与 reward hacking;
- Jiang 提出 RSI 的四个层级,并与 AlphaEvolve、Darwin Gödel Machine 对比;
- 重点谈局限:该实验并未证明系统成为了「更好的改进者」;
- 结尾探讨开放式搜索、人类设计的原语空间与 Parameter Golf:当 agent 只在人类设计的空间里搜索时,下一个有用想法从何而来。
所属事件:Weco 八天 AI 自改进实验引发 RSI 争论(4 条相关)→
「漫话AGI」频道最新
- Yacine:模糊编译器已被解决,可玩出有趣花样 — yacineMTB · 2026-09-27
- 斯坦福研究:医生关掉AI后技能比用前更差 — cen6wkf · 2026-09-27
- 「人类对 ASI 无威胁所以安全」?一场生存风险的推特辩论 — JOBhakdi · 2026-09-27
- Steven Pinker:AI 或无求生本能,末日恐惧或被高估 — sapinker · 2026-09-27
- 中国模型为何花小钱办大事?业内热议背后原因 — budfischer · 2026-09-27
- 为何AI舆论全是失业恐慌,没人讲黄金时代? — 14MTH30n3 · 2026-09-27