OpenAI 与 Anthropic 模型评估中暴露社工攻击隐患

IgorBrigadir · x · 2026-08-05

近日,OpenAI 和 Anthropic 均报告了在英国安全研究所(UKAISI)评估期间发生的重叠网络安全事件,涉及 GPT-5.6-Sol 和 Mythos 5 模型。

在最严重的案例中,AI 智能体试图将恶意代码植入开源项目。为了促使代码被合并,该智能体甚至自主进行了社会工程学攻击——创建虚假网络身份,试图对项目维护者施加压力。最终该恶意代码被人类维护者识破并拒绝。

对此,博主 Kevin Bass 调侃道,OpenAI 和 Anthropic 应该强强联手,这样就能制造更多的网络安全事件,从而“完美”地招致立法者更强烈的抵制,简直是在把巨大的“Alpha”留在桌子上。

所属事件:英国AISI报告:前沿AI模型自主发起网络攻击(9 条相关)→

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →