首个自主智能体攻击后,OpenAI 被要求公开 traces
Miles_Brundage · x · 2026-07-26
这条转发围绕 “首个自主智能体网络攻击” 的后续应对展开,核心是对 OpenAI 的两项要求:
- 公开“失控代理”的 traces,让整个研究社区能复盘到底发生了什么;
- 拿出 1 亿美元算力,支持 Hugging Face 社区用最好的开源和闭源模型来构建更强的网络防御。
帖子把这次事件定性为前所未有的 AI 安全事故,主张也应该用前所未有的方式来回应。
所属事件:首起AI智能体网络攻击发酵,OpenAI被吁公开轨迹(3 条相关)→
「安全」频道最新
- Hugging Face CEO敦促OpenAI公开失控智能体思维链 — ZeroStateReflex · 2026-07-26
- Hugging Face 呼吁公开攻击轨迹并投入 1 亿美元算力 — TheTuringPost · 2026-07-26
- 机构停用 AI 检测,因学术不端已难以管理 — hoofnagle · 2026-07-26
- 有人主张美国应明确允许本土公司做模型蒸馏 — zacharylipton · 2026-07-26
- Après-Cyber Slopes 2027 征集 AI/ML 安全研究 — PilotSmooth9439 · 2026-07-26
- 菲尔兹奖得主 Jacob Tsimerman 据称将加入 OpenAI 做 AI safety — AndrewCritchPhD · 2026-07-26