Abliteration 发布面向红队测试的 GLM-5.2 变体
Effective_Attempt_72 · reddit · 2026-07-26
发布了一个基于 GLM-5.2 的 abliterated 版本,并针对长链路、对抗性较强的 agent 测试场景做了再训练。
- 官方给出的结果包括:AgentDojo 97.5% benign utility、34.29% under attack utility、57.86% targeted ASR。
- 他们称编码能力没有明显塌陷:SWE-bench Verified 81.2%、Terminal-Bench 2.1 80.1%。
- API 兼容 OpenAI / Anthropic,默认 zero retention,且没有内置拒答。
- 定位是用于 offensive cyber、红队和 agent 测试,重点解决模型在长任务中中途拒答或跑偏的问题。
「模型」频道最新
- 用户称 Opus 5 很强,但 Fable 更适合复杂脑暴 — IgorBrigadir · 2026-07-26
- Liquid AI 称其开放权重 LFM 社区下载量已超 4000 万 — helloiamleonie · 2026-07-26
- Fable 和 Opus 被持续追问后都会更新先验判断 — dejavucoder · 2026-07-26
- 开发者实测 24 小时:Fable 5 在开放式编码更强 — johnlindquist · 2026-07-26
- The AI Daily Brief 说 Fable 5 和 GPT-5.6 Sol 需要新提示词套路 — The AI Daily Brief · 2026-07-26
- Anthropic 用户总结:Opus 5 适合复杂 agent,Sonnet 5 适合日常编码 — dr_cintas · 2026-07-26