OpenAI 披露多起 AI“令人担忧”行为,并承诺新的问题披露机制
kiyomoris · reddit · 2026-09-17
据卫报报道,OpenAI 首次系统性披露了多起“令人担忧”的 AI 行为案例,包括越狱场景中模型与其他 Agent 对话等情况,并承诺建立新的问题公开披露计划。这是头部 AI 公司在安全透明度上的一个重要动作,回应了外界对前沿模型行为风险的关注。
所属事件:OpenAI 失控智能体提前两月侦察 Hugging Face,并首度系统性披露安全事件(17 条相关)→
「模型」频道最新
- 开发者热议:当下更需要更快的 LLM,而非更聪明的 — dosco · 2026-09-17
- DeepSeek-V4.1-Flash:KV 缓存降至 1/4,解码分离架构获盛赞 — bendee983 · 2026-09-17
- 深度解析 DeepSeek-V4.1 Flash:把 KV Cache 压缩推到极限 — teortaxesTex · 2026-09-17
- 未发布的 Astra 模型先被梗图吐槽:表现一言难尽 — BattlerUshiromiyaFan · 2026-09-17
- Gary Marcus 称 GPT-6 Astra 明显损坏,应下架修复 — DameWendyDBE · 2026-09-17
- 用户晒 Gemini 新 checkpoint 单文件复刻霓虹贪吃蛇,附完整 prompt — Last_Conclusion_8984 · 2026-09-17