OpenAI 联合创始人:对齐模型不够,该「加固世界」
dawnsongtweets · x · 2026-09-24
- OpenAI 联合创始人 Wojciech Zaremba 提出:一个完美对齐的模型并不能让世界安全——这个领域可能瞄错了目标。
- 核心类比:火灾从来不是靠「变安全」的,是城市变安全了——消防栓、消防队、混凝土建筑、检查制度、保险机制共同降低了火灾危害。
- 他质疑当前领域把精力放在「加固模型」上,提出应当更重视「加固世界」:即在模型之外构建系统性的安全基础设施。
这是 Berkeley RDI 转发的观点,引发了对 AI 安全路径(模型对齐 vs 社会层防御)的讨论。
「漫话AGI」频道最新
- Anthropic:Claude 在噬菌体 DNA 中发现未知酶系统 — KevinKaichuang · 2026-09-24
- Altman 联合国警告递归自我改进:人类可能失去对 AI 的控制 — rohanpaul_ai · 2026-09-24
- Nina Schick:真信 AI 安全就该做多 AI 算力 — NinaDSchick · 2026-09-24
- Astra 发布后,纯研究机器人实验室的价值还剩什么? — mihdalal · 2026-09-24
- 递归自我改进的经济学:AI 加速自身的成本收益账 — CFGeek · 2026-09-24
- NBER 会议数据:去年美国主导 genAI,今年格局生变 — professor_ajay · 2026-09-24