开源与闭源性能差距已基本弥合,GLM-5.3 评分 60
Mysterious-Bison3735 · reddit · 2026-08-21
讨论开源与闭源模型差距缩小的现状及 GLM-5.3 的表现:
- 隐形渗透:中国开源模型已渗透进主流工具(如 Cursor Composer、Airbnb 使用 Qwen、GLM 埋在许多编码工具栈中),无需大肆宣传,仅需本地部署能力。
- 性能对比:Artificial Analysis 将 GLM-5.3 纳入指数,得分 60。其参数量仅为 Kimi K3 的 1/4,但得分持平;闭源模型最高分为 63。在 Agent 能力上,GLM-5.3 总体第二,仅次于 Opus 5,大幅甩开旧的开源领跑者。
- 本地价值:跑分是受控环境,对个人杂乱代码参考有限。核心价值在于能在自己的机器上运行,适合副业和内部脚本。虽然用户仍不敢直接扔进客户数据,但有人已用无保留托管跑真实业务。
- 代价:GLM-5.3 耗费 tokens 比 5.2 多约 20%(牺牲了“轻量”卖点),幻觉略增,且知识广度仍不及 Kimi K3。底层规模与 5.2 相同,提升纯靠训练。
观点:付费闭源模型的理由(能力差距)已基本消失,但模型产地是否仍具价值尚待观察。
所属事件:评测称 GLM-5.3 达前沿水平,开源闭源差距基本弥合(2 条相关)→
「公司和人」频道最新
- GitHub 难以替代的并非代码托管,而是社交生态 — threepointone · 2026-08-21
- 数据称中国模型占 OpenRouter 60% 流量,赢在性价比 — Parking-Banana-212 · 2026-08-21
- LangChain 宣布 10 月伦敦举办 Agent 开发者大会 Interrupt — LangChain · 2026-08-21
- 成功的初创公司不需要“温情”文化 — thedealdirector · 2026-08-21
- Uber 70% PR 由 Agent 生成,自研六大基建降本增效 — AI Engineer · 2026-08-21
- OpenAI 拟建 8GW 园区:3.5万岗后仅余2500,社区应争取什么? — Crescitaly · 2026-08-21