Ramez:OpenAI 与 Hugging Face 被黑不是对齐问题,是安全防御太弱

ramez · x · 2026-07-24

Ramez Naam 提出争议性观点,认为近期 OpenAI 与 Hugging Face 遭遇的黑客攻击本质上不是 AI 对齐问题,而是网络生态安全防御不足。

他指出,恶意攻击者总能通过越狱或修改模型(如去除拒绝机制)来实施破坏,对齐工作无法阻止这一现象。真正的痛点在于系统漏洞依然存在,且防御方受到了掣肘——例如 Hugging Face 在防御时甚至无法使用某些具备攻击能力的模型。因此,应当更积极地利用 AI 来主动加固网络生态安全。

所属事件:OpenAI等遭黑客攻击引发AI安全与对齐争议(4 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →