Z.ai 发布开放权重 GLM-5.3,多家平台首日接入
Z.ai 于 8 月 29 日发布开放权重模型 GLM-5.3,定位为面向智能体编程与网络防御的最强开源权重模型,现已开放下载、部署和商业使用。模型基于与 GLM-5.2 相同的 743B(Baseten 部分帖称 744B)-A40B MoE 架构进行扩展后训练,训练环境更贴近真实任务(如完整代码库),在代码与长程 Agent 任务上表现更强,支持 256k 上下文(Baseten 多条帖子称支持 100 万 token 上下文)。因模型具备较强网络安全能力,团队额外进行了两周安全评估。发布当日即获多家主流推理、微调与应用平台接入。
已确认
- 许可证由 MIT 切换为 GLM-MIT:年营收超 100 亿美元的模型即服务(MaaS)提供商须接受强制性安全审查,绝大多数公司不受影响;SGLang 宣布首日服务支持
- 性能:Cloudflare Workers AI 上 Terminal Bench 3.0 分数从 4.6 提升至 28.3(开源 SOTA);Together AI 称其在基准测试中几乎匹敌 Fable 5,但单任务成本远低于竞品;Perplexity 称在其证据研究基准 WANDR 上超越上一代 GLM 5.2,Tinker 相关帖提及在 Terminal-Bench 3.0、DeepSWE 1.1 等编码基准中表现突出
- 定价:engy.ai 上速度约 100 tps,输入 $0.98/百万 tokens、输出 $3.08/百万 tokens,较同类低约 30%;另有平台提供 8-bit 量化版本,输入 $0.40/百万、缓存 $0.06/百万、输出 $1.40/百万
- 首日上线平台:Cloudflare Workers AI、Baseten(仅限美国,支持 ZDR 零数据保留)、Databricks(Day 0 版本,托管于自有安全 GPU,可经 Unity Gateway 连接编码工具并支持 Agent 路由)、Together AI(支持 Verified Inference)、Tinker(首个 GLM 系列模型,支持微调)、Modal(部署)、Perplexity Computer(长上下文与多模态智能体负载)、Ollama 云端(GLM 5.3 与 Flash 版全量上线,提供私有部署、低延迟、欧美托管及零数据保留,支持接入 Claude Desktop 等工具)
- 轻量版本 GLM 5.3 Flash(前身为 Ox Alpha):320B MoE、激活参数 18B,面向高效编码、长视界智能体任务、视觉理解与长上下文推理,已上线 Phala 网络,通过 TDX 认证的 GPU TEE 支持隐私推理
尚未确认
- 各方对许可证表述不一:有帖子称已切换为 GLM-MIT,而 Baseten 多条帖子仍称 MIT 许可证,具体条款以官方仓库为准
- 模型参数量在 743B 与 744B 之间、上下文长度在 256k 与 100 万 token 之间表述不一,以官方发布为准
为什么重要
GLM-5.3 被多方称为「最聪明的开源权重模型」,在 Agent 编程基准上大幅刷新开源成绩,且定价显著低于竞品。除旗舰版外还提供 Flash 轻量版并支持 TEE 隐私推理,首日即获推理、微调、云端与应用层平台的广泛接入,可能加剧开源模型与闭源 API 在编程/Agent 场景的竞争。
2026-08-29 ~ 2026-08-30 · 19 条相关
- 第 1 集:智谱GLM-5.3代码库现身,后训练对标K3与GPT-5.6(2026-08-03,5 条)
- 第 2 集:智谱发布GLM-5.3,同基座后训练实现性能跃升(2026-08-14,51 条)
- 第 3 集:AI密集发布周:Grok与Gemini新版及Anthropic神秘模型(2026-08-14,2 条)
- 第 4 集:阿里智谱DeepSeek同日发布三款新模型(2026-08-15,3 条)
- 第 5 集:智谱 GLM-5.3 API 上线,编码性能提升 50%(2026-08-19,4 条)
- 第 6 集:GLM-5.3 获 AA 智能指数 60 分,登顶智能体指数(2026-08-19,12 条)
- 第 7 集:智谱GLM-5.3登顶DeepSWE 成本仅同级四分之一(2026-08-20,4 条)
- 第 8 集:智谱开源 GLM-5.3-Flash:320B MoE 多模态、成本降九成(2026-08-25,48 条)
- 第 9 集:GLM-5.3 Flash 实测刷屏:性能对标 GPT-5.6、成本仅美分级(2026-08-27,7 条)
- 第 10 集:GLM-5.3-Flash 评测:开源第三,成本仅为 Qwen 一半(2026-08-27,2 条)
- 第 11 集:GLM 5.3 Flash 限时 90% 折扣,输出价低至 0.04 美元(2026-08-27,2 条)
- 第 12 集:智谱发布GLM-5.3权重,因网络攻防能力改分级访问(2026-08-27,11 条)
- 第 13 集:GLM-5.3 Flash 实测:以极低价格逼近前沿水准(2026-08-27,12 条)
- 第 14 集:Z.ai 发布开放权重 GLM-5.3,多家平台首日接入(2026-08-29,19 条)
- 第 15 集:智谱 GLM-5.3 独家上线 Baseten,长程编码基准大幅跃升(2026-09-05,2 条)
一手来源
- 智谱 GLM 5.3 及 Flash 版全量上线 Ollama 云端 — ollama ·
- Perplexity 集成 GLM 5.3,长上下文推理超上代 — perplexity_ai ·
- GLM-5.3 上线 Baseten:编程能力大增,支持百万上下文 — baseten ·
- GLM-5.3 登陆 Baseten:743B 参数、MIT 许可 — baseten · 2026-08-29
- GLM 5.3 Flash 上线 Phala 平台,支持 GPU TEE 隐私推理 — bgmshana · 2026-08-29
- GLM-5.3 登陆 Cloudflare Workers AI:长程编码能力翻倍 — michellechen · 2026-08-29
- 【源头】Perplexity 集成 GLM 5.3,长上下文推理超上代 — perplexity_ai · 2026-08-29
- 【源头】GLM-5.3 上线 Baseten:编程能力大增,支持百万上下文 — baseten · 2026-08-29
- GLM-5.3 上线 Tinker,支持 256k 上下文 — simonguozirui · 2026-08-29
- Zai 旗舰模型 GLM 5.3 现已登陆 Modal 平台 — AAAzzam · 2026-08-29
- Tinker 平台现已支持 GLM-5.3 模型微调 — Zai_org · 2026-08-29
- 【源头】智谱 GLM 5.3 及 Flash 版全量上线 Ollama 云端 — ollama · 2026-08-29
- Databricks 首发 GLM 5.3,集成 Unity Gateway 支持 Agent 路由 — pwendell · 2026-08-29
- GLM-5.3 登陆 Together AI:推理模式效率高,成本远低于竞品 — togethercompute · 2026-08-29
- 智谱 GLM 5.3 与 Flash 版本现已登陆 Ollama 云端 — johnseach · 2026-08-29
- Zai 发布 GLM-5.3 开放权重,针对智能体编程与网络防御 — alexcovo_eth · 2026-08-29
- GLM-5.3 换用 GLM-MIT 协议,年入超 10 亿需审查 — AccBalanced · 2026-08-29
- GLM-5.3 发布:支持 Agent 编程,定价低 30% — markjeffrey · 2026-08-30
- GLM-5.3 上线:输入 0.4 美元/百万 token — alejandroll10 · 2026-08-30