OpenAI 研究员亲见对齐风险证据后转向,安全派质疑其为何仍留下
aiamblichus · x · 2026-08-25
一位安全社区作者针对 David Manheim 的转述提出质疑:许多 OpenAI 研究员原以为错位(misalignment)危险只是理论、进展会是渐进的,但在亲眼看到强证据后,越来越多的人开始改变看法。
作者的批评点是:如果风险真到了需要拿朝鲜和国家安全作类比的程度,把 RSI 系统只交给 NSA 并不能避免失控,甚至可能更糟——面对这种级别的错位风险,唯一安全的做法是根本不造这台末日机器。他不解为何当事人还在为该公司工作。
所属事件:越来越多 OpenAI 研究员开始重视对齐风险(2 条相关)→
「漫话AGI」频道最新
- David Brooks:AI 撰写评论将导致内容同质化 — zacharynado · 2026-08-27
- 英伟达百亿利润是否等于 GDP 新增?引发经济核算讨论 — EigenGender · 2026-08-27
- 前 OpenAI 员工自白:接近权力时的道德义务是不做齿轮 — RichardMCNgo · 2026-08-27
- 跑数周的Sol智能体蜂群自创私有词汇与留言板逻辑 — Sauers_ · 2026-08-27
- OpenAI 安全调查报告发布,存诸多未解疑问 — sjgadler · 2026-08-27
- 国产模型匿名出海:OxAlpha 爆火与身份谜团 — 创业邦 · 2026-08-27