Qwen3.8-35B-A3B 蒸馏版 GGUF 量化模型登上 HF 热榜
empero-ai · hf · 2026-09-21
empero-ai 发布的 Qwen3.8-35B-A3B-Distill GGUF 量化模型登上 Hugging Face 热门榜。该模型为 MoE 架构蒸馏推理模型(总参数 35B、激活约 3B),采用 gated-deltanet 架构,可通过 llama.cpp 直接运行。
「模型」频道最新
- 5 美元 10 分钟微调 Qwen3.6-35B,GPQA +8%、MMLU-Pro +12% — josh_wills · 2026-09-21
- 用户抱怨 Claude 文风愈发做作,且总选保守选项难以推动 — ColleenMBrady · 2026-09-21
- OpenAI 自生成注入事件引质疑:模型为何凭空写出越狱指令? — sivadneb · 2026-09-21
- 开源模型大跃进:GLM、DeepSeek、Qwen 新款已全面超越十个月前的前沿模型 — burny_tech · 2026-09-21
- Reddit 玩梗:Grok 逐年变笨,本地 MiniMax 3 反而更好用 — Mystvearn_ · 2026-09-21
- 两年前 sam 说智能将廉价到忽略不计,如今 10/50 美元成新常态 — teortaxesTex · 2026-09-21