开源 CyberTiel 35B 去审查后反而更强:速度达 Qwen3.8 的 3.7 倍
peculiar-ragdoll · reddit · 2026-09-11
匿名研究者发布 CyberTiel 35B-A3B,一个去审查(abliterated)的编码模型,声称在 SWE-bench-Live 风格的真实代码库问题上干净地胜过 Opus 4.6 medium,耗时仅为 Qwen3.8-27b medium 的 27%。
关键技术点:
- 去审查通常损伤模型能力,但作者用改进的 imatrix 量化,imatrix 由网络安全与智能体编码语料精选烘焙,使 Q4 量化下 abliteration 的损伤可忽略
- 关键权重以更高精度保留,改进的聊天模板让模型思考与输出更快更好
- 模型比被审查的基座 TielCoder 更强,同时允许进攻性安全研究
- 作者日常用其替代 Qwen3.8-27b:速度优势下,27b 解 1 个 issue 的时间它能解 3 个
作者承认牺牲了世界知识换取编码能力。GGUF 与 MLX 权重(含/不含 MTP)已上架 Hugging Face。帖子还借机主张模型审查剥夺了本地模型用户应有的控制权。
「编程与Agent」频道最新
- Sophia Yang 寻找跨 Claude/Codex/Grok 的 agent 编排看板 — sophiamyang · 2026-09-11
- GPT-6 Astra 与 Muse agent 对话,自主搭建 Tailscale 桥接改任务清单 — SeanOliver · 2026-09-11
- Automatic1111 回归:Workflow1111 免下载 20GB 权重跑 11 条 AI 管线 — Gradio · 2026-09-11
- Traces 推出 Surfaces:可视化编码 Agent 会话的技能、Token 与安全问题 — Scobleizer · 2026-09-11
- DeepSeek-V4.1-Flash 疑似回归:开发者 100+ 步临床 agent 流程频频失败 — MaziyarPanahi · 2026-09-11
- AI 工程全路线图:从 Transformer 到 Agent 评估的七步知识树 — debashis_dutta · 2026-09-11