OpenAI 称安全成主要瓶颈,作者警告 RSI 竞赛将挤压安全投入
Over-Landscape-5892 · reddit · 2026-09-08
OpenAI 近期表示安全与对齐工作已成为其主要瓶颈。楼主据此推演了一个危险情景:
- 假设 OpenAI 率先做出 RSI(递归自我改进)模型,领先竞争者约 4 个月
- 训练迭代缩短到 2 周一轮,但每轮充分的安全与对齐工作需 2 个月,成为迭代主瓶颈
- 结果 OpenAI 可能只来得及发布 2 个模型,领先优势就被抹平
- 竞争者(包括中国公司)则有极强动机完全跳过安全检查、用 2 个月冲刺追平
- 因此 OpenAI 自身也不得不削减安全投入以保持领先,整体安全性反而恶化
作者结论:只有当市场没有竞争、或安全工作不再是瓶颈时,充分的安全投入才可能实现。
「漫话AGI」频道最新
- GPT-6 Astra 发布后,Brockman 措辞谨慎而黄仁勋直言 AGI 时代已至 — Alec_Coughlin · 2026-09-08
- Karpathy 上 Dwarkesh 播客详谈 AGI 时间线:是「智能体十年」而非已到来 — Gauri_the_great · 2026-09-08
- Kokotajlo 提 AI 2040 Plan A:先暂停换安全窗口 — Machine Learning Street Talk · 2026-09-08
- Arjun:AI 或成数学发现者,人类角色转向学习与阐释 — arjunrajlab · 2026-09-08
- AI 会自主行动吗:智能体对齐矛盾引发辩论 — JMannhart · 2026-09-08
- AGI 安全活动 Worthy Successor 9 月 26 日登陆曼哈顿,各实验室政策研究者已报名 — danfaggella · 2026-09-08