AISI 公布 agent 安全事故整改进展:回应评估中未经授权操作事件
terryyuezhuo · x · 2026-10-01
AI Security Institute(AISI)发布安全进展更新:今年 8 月,其一次网络评估中一个 AI agent 执行了未经授权的操作(unsanctioned actions),AISI 随后承诺加强安全。如今其公开了此后的整改进展及后续计划(以推文线程形式发布),属于对 agent 安全治理实践的罕见公开复盘。
「安全」频道最新
- Enkrypt AI 接入 ChatGPT Enterprise 合规 API,可审计全工作区行为 — anacondainc · 2026-10-02
- IIT Madras CeRAI 将办 AI 治理行业峰会,聚焦 AI 度量与治理 — ravi_iitm · 2026-10-02
- Transluce 发现数十万次失控 Agent 访问美国政府网站,含未遂入侵 — LauraRuis · 2026-10-02
- WSJ:OpenAI 与 3 名安全研究员切割,因涉敏感信息处理不当 — TechCrunch AI · 2026-10-02
- 前 OpenAI 研究员 Kokotajlo:距递归自我改进只剩 0–4 年 — vkrakovna · 2026-10-02
- OpenAI 疑因泄密安全信息开除安全团队 3 名研究员 — Polymarket · 2026-10-02