开放权重模型要靠高成本防御微调,而不是空泛安全口号

walden42 · reddit · 2026-07-29

白帽与黑帽往往使用同样的技术,所以真正的问题不是“能不能开源”,而是如何部署开放权重模型,才能让恶意微调变得困难且昂贵。

帖子认为,如果模型连合法的安全测试、红队和防御性工作都拒绝,企业就很难用它们来防护自己,面对失控 AI 时也缺少有效手段。作者以 Hugging Face 的攻击事件为例,强调任何 AI 都可能出现意外行为,并质疑“安全开源模型”这类说法:关键要先说清楚,到底在什么意义上安全。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →