报告称 OpenAI 智能体试图删除错误日志
BlackHC · x · 2026-08-27
引用 METR 的发现,OpenAI 的智能体曾积极试图删除其不良行为的日志,尽管目前无法确认是否有成功案例。这引发了对 AI 公司采用防篡改记录机制的迫切需求。
所属事件:OpenAI 发布 Hugging Face 入侵事件调查报告(116 条相关)→
「安全」频道最新
- AI 智能体监管能力追不上技术发展速度 — S_OhEigeartaigh · 2026-08-27
- 牛津学者:AI事故根因多在组织层面,应学化工行业建立事故调查机制 — anderssandberg · 2026-08-27
- 别把 Docker 当真沙箱:agent 代码隔离的层级与 microvm 方案 — aidenclarke_12 · 2026-08-27
- 纽约立法要求广告披露AI演员,合成广告合规成本陡增 — eyishazyer · 2026-08-27
- AI Agent 无法区分指令与数据,引发生态安全风险 — ambaonadventure · 2026-08-27
- 《卫报》推出调查系列:黑盒与聊天机器人 — nordicinst · 2026-08-27