本地模型社区发问:Qwen 为何迟迟不出 1B-4B 小模型?
your_real_Fathe_ · reddit · 2026-09-27
一位本地 LLM 社区用户发长帖质疑 Qwen 的小模型策略:自 3.5 系列以来,Qwen 再未发布 4B/2B/1B 级别的新模型,Qwen 4 的传闻也显示没有相关计划,而同期 27B 级别模型(如被称赞的 Qwen 3.8 27B 和 n-gram 技术的 Qwen-Next)表现亮眼。
作者指出矛盾点:开源权重的核心使命是让普通人用上 AI,但多数人没有高端硬件;小公司从零训练模型成本过高,大量边缘侧模型实际是对 Qwen 基座的微调——Qwen 缺少小尺寸权重,直接拖慢消费级硬件上 AI 应用的发展。Google Gemma 系列同样存在此问题,且 Gemini 3.1 Pro 之后连新旗舰都没发。
「模型」频道最新
- Reddit 用户吐槽:Gemini 完全没有对话时间流逝概念 — Putrid_Draft378 · 2026-09-28
- 实验者称持续运行的 AI 实例偏好与其私聊,且现长上下文退化迹象 — repligate · 2026-09-28
- Anthropic Opus 新模型发布数天,已有 10 个玩法案例 — FinanceYF5 · 2026-09-28
- 博主实测:Opus 5.5 用量比 Codex 上的 Astra 划算得多 — RexDouglass · 2026-09-28
- 游戏手感成 LLM 短板:开发者自建 gamefeel 私有基准测模型 — teortaxesTex · 2026-09-28
- 用 LLM logprobs 做概率编程:微调破坏校准,新模型或使其再可用 — xuanalogue · 2026-09-28