Abliteration 移除 GLM-5.3 防护,引发政策担忧
Afinetheorem · x · 2026-09-02
Abliteration AI 发布了基于 GLM-5.3 的 abliterated-model-large-v2 模型,声称移除了安全防护,专门用于执行攻击性网络任务、红队测试和 Agent 测试。该模型提供 100 万上下文窗口且不保留输入输出记录。
ChrisRMcGuire 指出,移除开源权重模型的安全防护极其容易,这具有巨大的政策影响。他认为该模型作为具有明确攻击能力的闭源权重模型(虽基于开源微调),理应接受美国政府的发布前测试。
所属事件:Abliteration 发布基于 GLM-5.3 的去审查模型(5 条相关)→
「模型」频道最新
- 专家质疑 OpenAI Astra 评估存数据污染与元游戏风险 — ShakeelHashim · 2026-09-02
- Astra 刷爆 ExploitBench 百分百胜率,达网安临界能力 — infoxiao · 2026-09-02
- Anthropic 用激活探针检测 Claude 网络安全威胁 — nrehiew_ · 2026-09-02
- RWKV-7 G1j 发布:纯 RNN 架构在 agent 与编码任务大幅增强 — jeremyphoward · 2026-09-02
- Fable 5.1 三十分钟一次成型可用的吉他 VST 插件 — CtrlAltDwayne · 2026-09-02
- Fable 5.1 自选目标解开 373 年历史密码 — rickasaurus · 2026-09-02