社区发布 27B 无审查微调模型,用 Marchenko-Pastur 蒸馏训练噪声

EvilEnginer · reddit · 2026-09-09

Reddit 用户发布 Qwen3.8-27B-Uncensored-Genesis-V1 的 GGUF 版本,试图解决 LLM 推理时输出冗长、浪费 token 的问题。作者的理论是训练噪声导致张量矩阵数值不稳定,于是基于一篇 2014 年数学论文,用 Marchenko-Pastur 分布从张量中「蒸馏」训练噪声。

作者给出了推荐推理设置(temperature=1.0、topp=0.95、topk=20、reasoningeffort=medium),但坦承自己只有 12GB 显存的 RTX 3060,无法充分测试,征集社区反馈。方法有效性存疑,属于实验性社区项目。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →