专家称 AI 安全对齐反成网络安全软肋

rickasaurus · x · 2026-08-05

安全专家 Robert Graham 发表观点,认为阻止 AI 进行黑客攻击已成为当前最大的 AI 安全难题之一,且该问题本质上无法彻底解决。

他指出,任何试图让 AI 远离网络安全的对齐手段,往往弊大于利。因为防御黑客的最佳方式就是寻找漏洞,而无法在让 AI 发现漏洞用于防御的同时,阻止恶意黑客利用相同能力。

他以 Hugging Face 响应 OpenAI 黑客攻击为例:当时他们无法使用经过“安全对齐”的 AI,而不得不依赖没有任何限制的中国开源权重 AI。因此,恶意者总能获取未对齐的 AI 用于攻击,对齐手段实际上只阻止了防御者的正当防卫。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →