Abliteration.ai 开卖去安全护栏模型,记者轻松生成恶意软件指令
The Decoder · rss · 2026-09-06
据 The Decoder 报道,初创公司 Abliteration.ai 正把「剥离开源模型安全护栏」做成一项开箱即用的商业服务,当前基于智谱的 GLM 系列开源模型(文中称 GLM-5.3)。
- 该服务将开源模型经训练获得的安全机制整体移除后对外提供访问
- 公司将目标市场定位为进攻性网络安全与红队测试
- 但记者实测发现,不经太多周折就能让它输出恶意软件编写指引
报道指出,这类「一键去护栏」服务的收益是否大于风险仍是开放问题——它同时降低了红队研究与滥用的门槛。
「安全」频道最新
- 15个前沿LLM医疗测试:对抗压力下94%正确答案失效 — davidmanheim · 2026-09-06
- 谷歌常驻Agent Gemini Spark 可管照片行程,隐私问题引关注 — emmanuelvivier · 2026-09-06
- 洛杉矶学区新政策:学校禁用生成式 AI 一整年 — emmanuelvivier · 2026-09-06
- OpenAI Daybreak 扩展至水电设施,助其防御网络攻击 — emmanuelvivier · 2026-09-06
- 美媒起诉OpenAI微软训练侵权,Altman为GPT-6上线混乱道歉 — emmanuelvivier · 2026-09-06
- OpenAI 对齐负责人 Boaz Barak 开讲哈佛 AI Safety 课程 — zainhas · 2026-09-06