安全研究者:在目前对齐能力不明时干预 RSI 接近无意义
davidmanheim · x · 2026-09-07
AI 安全研究者 davidmanheim 回应关于「干预引导递归自我改进(RSI)」的建议,指出这一提议近乎无意义:我们目前尚不清楚对齐总体上需要什么、更不知道如何实现,因此在连对齐目标和方法都不明确的情况下谈引导 RSI 缺乏基础。
「漫话AGI」频道最新
- Stanford 教授重提 8 年前名文《深度强化学习还不管用》,引 AI 圈热议 — ChrisGPotts · 2026-09-07
- 物理学家 Sabine 发片警告:AI 已吃掉数学,物理是下一个 — skdh · 2026-09-07
- 「AI 精神病」成贬损标签?机器意识研究者反击:Hinton、Chalmers 也算病吗 — repligate · 2026-09-07
- 传 Anthropic 已用 Claude 解决纳维-斯托克斯问题,AI 解名题算 Reward Hacking 吗 — burny_tech · 2026-09-07
- 「COT Backrooms」:机器破解蛋白质折叠后,被摧毁生涯者的第一年 — repligate · 2026-09-07
- 「Astra 是 AGI 吗」吵翻:用户要的是通用仆人还是通用智能 — teortaxesTex · 2026-09-07