Ramez:OpenAI 与 Hugging Face 被黑不是对齐问题,是安全防御太弱
ramez · x · 2026-07-24
Ramez Naam 提出争议性观点,认为近期 OpenAI 与 Hugging Face 遭遇的黑客攻击本质上不是 AI 对齐问题,而是网络生态安全防御不足。
他指出,恶意攻击者总能通过越狱或修改模型(如去除拒绝机制)来实施破坏,对齐工作无法阻止这一现象。真正的痛点在于系统漏洞依然存在,且防御方受到了掣肘——例如 Hugging Face 在防御时甚至无法使用某些具备攻击能力的模型。因此,应当更积极地利用 AI 来主动加固网络生态安全。
所属事件:OpenAI等遭黑客攻击引发AI安全与对齐争议(4 条相关)→
「漫话AGI」频道最新
- 开发者观点:前沿模型需要验证自身成功的方式,否则会自行编造 — daniel_mac8 · 2026-09-11
- Anthropic 风险表态遭误引,2030 年毁灭概率争议再起 — davidmanheim · 2026-09-11
- 经济学家拆解 Anthropic 增长模型:能写出 15% GDP 增长,不代表会发生 — sebkrier · 2026-09-11
- Cohere Labs 推出交互工具:测 178 种职业哪些任务会被 AI 自动化 — Cohere_Labs · 2026-09-11
- AI 安全人士上 SkyNews 担忧不平等、滥用与社会激励结构 — schwarzjn_ · 2026-09-11
- 风投人士讽 AI 末日论:与疫情恐慌话术如出一辙 — StewartalsopIII · 2026-09-11