实测 Qwen3.8-27B 知识储备较 3.6 退步
EmPips · reddit · 2026-08-20
用户通过个人冷知识基准测试发现,Qwen3.8-27B 在回答事实性问题上表现不如前代 Qwen3.6,这一观察也与第三方离线知识基准数据一致。虽然模型在代码等任务上依然强劲,但对于依赖模型权重内部知识而非工具调用的离线场景可能不是最佳选择。
「模型」频道最新
- 斯坦福框架助 DeepSeek 超越 Claude,成本仅 1/11 — FuSheng_0306 · 2026-08-20
- Qwen3.8-Max 登顶前端代码榜单,超 Claude Fable 5 — Alibaba_Qwen · 2026-08-20
- 观点称 Gemini 3.1 Pro 在多项基准中仍是最强 — Last_Conclusion_8984 · 2026-08-20
- Qwen3 驱动 ASR 模型 superwhisper/s1-mini 登顶 HF 热榜 — superwhisper · 2026-08-20
- Qwen3.8 27B 性能提升 3 倍,展示开源模型迭代优势 — TheMoonMidas · 2026-08-20
- Mac 本地运行 27B 多模态模型,三年前不可想象 — TheMoonMidas · 2026-08-20