越来越多 OpenAI 研究员开始重视对齐风险
安全社区讨论指出,许多 OpenAI 研究人员过去认为错位(misalignment)危险只是理论性的,且 AI 进展会是渐进的,但在亲眼看到强有力的证据后,越来越多的人正在改变想法、转向重视对齐风险。有安全派人士质疑,既然这些研究员已确认风险证据,为何仍选择留在 OpenAI。
2026-08-25 ~ 2026-08-25 · 2 条相关
- 观点:越来越多OpenAI研究者开始重视对齐风险 — davidmanheim · 2026-08-25
- OpenAI 研究员亲见对齐风险证据后转向,安全派质疑其为何仍留下 — aiamblichus · 2026-08-25