OpenAI 被要求公开失控代理轨迹,并投入 1 亿美元防御算力
Miles_Brundage · x · 2026-07-26
这条转述的是围绕 OpenAI 网络攻击事件后的两点诉求:一是公开“失控”代理的 traces,让研究界能复盘;二是拿出 1 亿美元算力,帮助 HF 社区构建更强的网络防御。
- 核心诉求是“前所未有的透明度”:把攻击轨迹公开出来。
- 另一项诉求是让 OpenAI 以算力支持防御能力建设。
- 但作者明确提醒:这笔钱不应来自 OpenAI foundation,否则就像是在用非营利资金处理 PBC 可能承担的责任。
「安全」频道最新
- 机构停用 AI 检测,因学术不端已难以管理 — hoofnagle · 2026-07-26
- 有人主张美国应明确允许本土公司做模型蒸馏 — zacharylipton · 2026-07-26
- Après-Cyber Slopes 2027 征集 AI/ML 安全研究 — PilotSmooth9439 · 2026-07-26
- 菲尔兹奖得主 Jacob Tsimerman 据称将加入 OpenAI 做 AI safety — AndrewCritchPhD · 2026-07-26
- OpenAI 网络防御资助引发基金会资金与 PBC 责任争议 — Miles_Brundage · 2026-07-26
- AI对齐指南更新至v9:核心发现已扩展验证至72B参数 — Fantastic_Aside6599 · 2026-07-26