开源权重模型落后闭源仅 4 个月,适用边界在哪里
TechPreacher · x · 2026-10-02
作者结合自己用两节点 NVIDIA DGX Spark 集群运行 GLM-5.3-Flash 的实践,划定了开源权重模型的适用边界。
核心数据:Epoch AI 的 Capabilities Index 显示,自 2026 年 1 月以来最佳开源模型平均落后闭源前沿约 4 个月(8 个指数点,约等于 GPT-5 与 GPT-5.5 的差距)。GLM-5.3-Flash(Z.ai 8 月发布,MIT 许可,320B 总参/18B 激活,1M 上下文,支持图文视频输入)与 Claude Opus 4.8 的对比中,多项基准互有胜负(Terminal Bench 2.1:84.3 vs 85.0;DeepSWE v1.1:63.4 vs 58.0;NL2Repo:56.3 vs 69.7),但注意这是厂商自报数据,且 Opus 4.8 已非 Anthropic 最新。
结论:开源模型不是前沿模型的全面替代,但在三种场景下是正确选择——任务有边界且可验证、数据不能出内网、需要没人能重新定价/限流/下线的端点。正确的问题不是「哪个模型最好」,而是「这个任务哪个模型够用」。
「Infra」频道最新
- DGX Spark 被 Linux 隐藏 4.1 GiB 内存,两个技巧找回 — marian_nmt · 2026-10-02
- 断网医院里本地模型成救命工具:24GB 内存可跑 Qwen3-4bit — AaronBergman18 · 2026-10-02
- TensorFold 0.6.1 上线 DGX Spark 性能大增:8 流提速 36% — EAccelerate_42 · 2026-10-02
- 谷歌首颗太空算力原型卫星随 SpaceX 发射成功 — elonmusk · 2026-10-02
- 别再租用 AI 记忆:Qdrant Edge 离线演示 15MB 端侧亚毫秒向量检索 — AI Engineer · 2026-10-02
- 传三星 HBM4 报价超 4 美元/Gb,达 HBM3E 三倍以上 — zephyr_z9 · 2026-10-02