开发者警告:恶意者可「消融」中国模型安全护栏用于黑客攻击

willcb · x · 2026-09-30

开发者 willcb 发推称,企业版计划将保留模型安全能力,但很快恶意攻击者可能通过 abliterate(消融安全微调)手段把中国模型改造得几乎和 Opus 5 一样有助于恶意黑客攻击,或借助半成品的 Sol 6 checkpoint 实现,所需不过一个 prompt 或少许加工。帖子指出了开源/易获取模型安全护栏被剥离的现实风险。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →