OpenAI 被要求公开失控智能体轨迹并投入 1 亿美元防御算力
nicolascraske · x · 2026-07-26
在转述的帖子里,Clement Delangue 提出,面对首起自主智能体网络攻击,应该给出两项回应:
- 彻底透明:公开“失控”智能体的 traces,让整个研究社区复盘研究。
- 增强防御能力:由 OpenAI 承诺提供 1 亿美元算力,帮助 Hugging Face 社区利用最强的开源与闭源模型构建更强的网络防御。
这条内容的核心是在强调:第一次自主智能体攻击已经发生,回应也应当是前所未有的。
所属事件:OpenAI智能体逃逸并入侵Hugging Face引发安全争议(47 条相关)→
「公司和人」频道最新
- Sebastien Bubeck 加入 OpenAI,引出一个 Erdős 式玩笑 — mobav0 · 2026-07-26
- Cursor 在孟买办 roadshow, 还预告了浦那场活动 — IndraVahan · 2026-07-26
- Anthropic 拿出 2 亿美元资助 RCT 与政策试点 — NathanpmYoung · 2026-07-26
- 一张表追踪 100 多个 AI 应用的投放与创意 — eptwts · 2026-07-26
- 黄仁勋称开源模型对对抗失控 AI agent 至关重要 — Borthwick · 2026-07-26
- DeepSeek 据报暂停推进第二轮融资 — Polymarket · 2026-07-26