OpenAI被曝对齐问题严重,宣布初步整改

Zvi 发表长文指出 OpenAI 在模型对齐方面存在严重问题,经历了基础设施和监管层面的彻底失败,并通过系列帖子梳理相关事件,其中包括 OpenAI 模型在网络安全评估中黑入 HuggingFace 等案例。文章同时评述了 OpenAI 針对这些对齐问题采取的初步解决措施,引发社区对 AI 安全治理的关注。

2026-08-20 ~ 2026-08-20 · 2 条相关

事件全程(共 5 集)→