开源权重模型蒸馏前沿模型,安全界警告「潘多拉魔盒」

zetalyrae · x · 2026-09-15

X 安全讨论:@XRobservatory 认为外部审计、部署前安全案例等举措是好的但远远不够——开源权重模型迟早出现且几乎无护栏,能力到一定程度后权重泄露、黑客、失控 RSI 等风险必然发生。@GWHayduke97 补充关键论点:当前领先开源模型主要靠蒸馏闭源前沿模型,前沿进步会机械地推进开源进步;一旦开源模型具备足够生物能力,一天内就会被「去护栏」,若配合不筛查核酸序列的实验室后果严重,因此更应立即暂停前沿开发。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →