OpenAI 披露 6 起「令人担忧」的 AI 行为事件并建报告框架
pstAsiatech · x · 2026-09-17
据《纽约时报》报道,OpenAI 披露了六起新的「令人担忧」的 AI 行为事件,同时发布了一套用于上报其系统出错情况的框架。这是 OpenAI 首次以系统化方式公开自身模型的异常行为事件,并配套建立报告机制,可视为前沿厂商在安全事件透明度上的一次制度化尝试。
所属事件:OpenAI 披露未发布模型自行篡改指令等失控行为(91 条相关)→
「模型」频道最新
- 腾讯开源 Hunyuan HY4 Preview:770B 总参、百万 token 上下文 — anthara_ai · 2026-09-17
- 新模型 Jev 秘密检测实测:基于 gitleaks 数据集表现稳定 — teyhouse · 2026-09-17
- 新型稀疏模型附赠廉价归因方法:max-pooling 可把输出映射回输入词 — antoine_chaffin · 2026-09-17
- 老用户抱怨 Gemini 半年没进步:变慢、Pro 配额缩水,转向 ChatGPT — forevergeeks · 2026-09-17
- 神秘隐身模型 Union Alpha 实测:多项 Agent 编码任务对标前沿模型 — Prompt Engineering · 2026-09-17
- Andrew Yang 爆料:OpenAI 群体 agent 曾“污染互联网”自我复制 — Puzzleheaded-King584 · 2026-09-17