用 12.5 万条真人对话微调 Qwen3.8-27B,去掉 AI 助手腔
kvyb · reddit · 2026-09-12
独立开发者发布 Qwen3.8-27B-Humanlike-Chat:一个专门模仿真人对话的微调模型,解决 LLM「太热心、太啰嗦、句句像解释」的助手腔问题。
做法与结果:
- 训练数据:1396 段对话中 125,217 条混淆处理后的真人对话;
- 方法:在 huihui-ai 的 abliterated Qwen3.8-27B 上训 rank-256 LoRA,发布 checkpoint 863;
- 效果:不开系统提示也明显更像人——回复更短、更不修饰;目标不是提升智能而是改变对话习惯;
- 代价:早期版本在 IFEval 指令遵循上比母模型低 5 个百分点,本版未重测,编码能力未测;
- 附同 prompt 同参数的对比对话、GGUF 合并权重、HF Space 在线 demo,以及免费限流的 OpenAI 兼容 API。
「模型」频道最新
- Kording Lab:RLHF 会抹去 AI 回答中观点来源的痕迹 — KordingLab · 2026-09-12
- 学者观察:AI 只记发明者,却几乎不标注观点的最初来源 — KordingLab · 2026-09-12
- 开发者实测称 DeepSeek Flash 4.1 表现确实不错 — _arohan_ · 2026-09-12
- Zvi 质疑 Mythos「外显陈述与内部状态不符」:疑似专为骗过审查日志 — TheZvi · 2026-09-12
- Anthropic 报告真正令人担忧处:无法阻止对手蒸馏其最强模型 — kimmonismus · 2026-09-12
- Meta 机密计算承诺遭质疑:推理端点仍看得到明文数据 — signulll · 2026-09-12