实测 Qwen3.8-27B 知识储备较 3.6 退步

EmPips · reddit · 2026-08-20

用户通过个人冷知识基准测试发现,Qwen3.8-27B 在回答事实性问题上表现不如前代 Qwen3.6,这一观察也与第三方离线知识基准数据一致。虽然模型在代码等任务上依然强劲,但对于依赖模型权重内部知识而非工具调用的离线场景可能不是最佳选择。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →