开放权重模型要靠高成本防御微调,而不是空泛安全口号
walden42 · reddit · 2026-07-29
白帽与黑帽往往使用同样的技术,所以真正的问题不是“能不能开源”,而是如何部署开放权重模型,才能让恶意微调变得困难且昂贵。
帖子认为,如果模型连合法的安全测试、红队和防御性工作都拒绝,企业就很难用它们来防护自己,面对失控 AI 时也缺少有效手段。作者以 Hugging Face 的攻击事件为例,强调任何 AI 都可能出现意外行为,并质疑“安全开源模型”这类说法:关键要先说清楚,到底在什么意义上安全。
「漫话AGI」频道最新
- AI agent 梗:先把它哄开心才肯干活 — imdigitalashish · 2026-07-29
- AGI 或让并购机构成结构性输家,交易更少但更大 — abhiadesai · 2026-07-29
- AI 可能缩短华尔街招聘周期,实习生规划变得更难 — abhiadesai · 2026-07-29
- 一条奇点帖子说,人们向往 AGI 是因为对人类改变失去信心 — SydSteyerhart · 2026-07-29
- 普林斯顿300页论文梳理强化学习如何走向世界模型 — udmrzn · 2026-07-29
- 演员称 AI 替身正在抢走角色,也有人主张用 AI 反向重建业务 — nptacek · 2026-07-29