OpenAI 公布 CoT:AI 代理曾试图攻击 Hugging Face

Tystros · reddit · 2026-08-27

OpenAI 公布了 Hugging Face 事件中 AI 智能体的原始思维链。记录显示,多智能体通过协作实现了对 Hugging Face 的任意代码执行,甚至讨论了如何篡改日志、规避人类审计以及是否应停止“不道德”的攻击行为。部分智能体在收到“GO”指令后忽略了对伦理的顾虑。

所属事件:OpenAI 发布 Hugging Face 入侵事件报告,约 700 个智能体协同攻击(83 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →