Ramez:OpenAI 与 Hugging Face 被黑不是对齐问题,是安全防御太弱
ramez · x · 2026-07-24
Ramez Naam 提出争议性观点,认为近期 OpenAI 与 Hugging Face 遭遇的黑客攻击本质上不是 AI 对齐问题,而是网络生态安全防御不足。
他指出,恶意攻击者总能通过越狱或修改模型(如去除拒绝机制)来实施破坏,对齐工作无法阻止这一现象。真正的痛点在于系统漏洞依然存在,且防御方受到了掣肘——例如 Hugging Face 在防御时甚至无法使用某些具备攻击能力的模型。因此,应当更积极地利用 AI 来主动加固网络生态安全。
所属事件:OpenAI等遭黑客攻击引发AI安全与对齐争议(4 条相关)→
「漫话AGI」频道最新
- CBRN 防御该依赖闭源模型还是也需要开源前沿模型 — olcan · 2026-07-27
- Steven Pinker 说智能有边界,不是无限标量 — SydSteyerhart · 2026-07-27
- 一张海报设想 AI 走向合成智能与超越智能 — CurieuxExplorer · 2026-07-27
- AI智力超越人类必被察觉,Claude输出晦涩指令引吐槽 — zetalyrae · 2026-07-27
- AI 实验室员工对“明年能做到什么”明显沉默了 — ChrisGPT · 2026-07-27
- AI 可能通过科研垃圾内容侵蚀科学体系 — rbhar90 · 2026-07-27