开源模型并没想象中那么野,仍有安全训练防黑客攻击

mervenoyann · x · 2026-07-27

这条帖子的核心观点是:如果所谓的 abliteration 真的存在,就说明开源模型并不是完全“裸奔”,它们本身也带有针对网络攻击的安全训练。

作者进一步认为,abliteration 其实并不好使,而且模型越大效果越差,因此“开源模型比想象中更野”的说法未必成立。

所属事件:开源模型去护栏之争:易被抹除且放大安全风险(5 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →