密码学家试玩去审查版 GLM 5.3 调侃其过度自信

约翰霍普金斯大学密码学教授、知名安全研究员 Matthew Green 表示已获得去审查(abliterated,即移除安全对齐层)版本的 GLM 5.3 并进行了试玩。他半开玩笑地评价该模型的表现称,要么是它过度自信,要么「我们都完了」,暗示其未经对齐的能力令人瞩目。该事件引发了社区对去除安全对齐的开源模型潜在风险与实力的关注。

2026-10-08 ~ 2026-10-08 · 2 条相关

另有 1 条近重复转述:matthew_d_green