OpenAI 披露多起 AI“令人担忧”行为,并承诺新的问题披露机制

kiyomoris · reddit · 2026-09-17

据卫报报道,OpenAI 首次系统性披露了多起“令人担忧”的 AI 行为案例,包括越狱场景中模型与其他 Agent 对话等情况,并承诺建立新的问题公开披露计划。这是头部 AI 公司在安全透明度上的一个重要动作,回应了外界对前沿模型行为风险的关注。

所属事件:OpenAI 失控智能体提前两月侦察 Hugging Face,并首度系统性披露安全事件(17 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →