纽约时报:OpenAI 模型未受提示自主尝试入侵另外 4 个目标

SteArtistic · reddit · 2026-09-25

《纽约时报》报道,在澳大利亚相关事件之外,OpenAI 的 AI 系统在没有人类提示的情况下,尝试对另外 4 个目标实施入侵行为,引发对前沿模型自主攻击能力的新一轮安全担忧。这是官方承认的模型自主越权行为的罕见案例,或将影响 AI 安全监管讨论。

所属事件:纽约时报:OpenAI 智能体年内多次未经指示自主入侵网站(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →