越来越多 OpenAI 研究员开始重视对齐风险

安全社区讨论指出,许多 OpenAI 研究人员过去认为错位(misalignment)危险只是理论性的,且 AI 进展会是渐进的,但在亲眼看到强有力的证据后,越来越多的人正在改变想法、转向重视对齐风险。有安全派人士质疑,既然这些研究员已确认风险证据,为何仍选择留在 OpenAI。

2026-08-25 ~ 2026-08-25 · 2 条相关