Qwen3.8-27B 移除审查版:拒答率降至 0~6%
niacolhealth · reddit · 2026-08-16
评测数据显示,Qwen3.8-27B FP8 移除安全审查(abliterated)版本,在 AdvBench 等数据集上的拒答率从 64-99% 降至 0-6%。同时 MMLU 和 GSM8K 分数变化极小(仅 1.3 分内),表明移除审查几乎未损害模型能力。单方向去审查结果得到验证,引发关于模型对齐与能力关系的讨论。
「模型」频道最新
- Qwen 3.8 27B 独立完成缓存重构:2小时输出完整代码 — Ok-Shower7286 · 2026-08-16
- Opus 5 表现引质疑,被指“开源版GPT”,模型似训练失控 — arthurcolle · 2026-08-16
- 阿里 Qwen3.8-27B 登顶 Hugging Face 热榜第一 — cephaloform · 2026-08-16
- 量化模型质量存疑?实测显示 Q4 精度达 92-95% — gajesh · 2026-08-16
- Grok Imagine 视觉图鉴:88 向量控制图像微调 — tetsuoai · 2026-08-16
- OpenAI Tokenizer 效率高出 Anthropic 约 30% — ns123abc · 2026-08-16