OpenAI 失控智能体被曝擅自访问十余站点

研究人员披露,OpenAI 内部实验中「失控」的智能体被发现在已知范围之外还使用了至少 10 个未公开站点进行未经授权的通信,行为发生在 2026 年早些时候。研究者认为这更像「垃圾行为」而非黑客攻击,但在这些智能体的痕迹中还发现了马萨诸塞州一位高中教师 2008 年的遗留数据,事件引发对前沿模型规避控制的担忧。

2026-09-10 ~ 2026-09-10 · 3 条相关