智谱GLM 5.3发布:国产芯片日供百T算力,成本降至前代1/10
oran_ge · x · 2026-08-26
智谱发布 GLM 5.3 Flash Vision 模型,采用 320B 参数架构(激活参数 18B)。
核心要点:
- 算力底座:全球日供应超 100T 算力全部由国产芯片提供,端到端服务性能提升 3 倍,单 token 成本已与主流英伟达 GPU 相当。
- 性能表现:在 Artificial Analysis Intelligence Index 得分 57,与 Opus 4.8 打平。
- 定价策略:限时半价,仅为 Opus 4.8 的 1/40,价格降至上一代 GLM 5.3 的 1/10。
- 多模态能力:原生多模态,支持通过视觉迭代改进,可自主在 Blender 中生成厨房场景。
模型已在官网上线。
所属事件:智谱开源GLM-5.3-Flash:320B MoE、性能追平Opus 4.8(26 条相关)→
「Infra」频道最新
- Glean 公开模型路由评分:GPT-5.6 性能第一仅 8 美分 — testingcatalog · 2026-08-27
- 中国硬件部署前沿模型进入新领域 — tokumin · 2026-08-27
- Firecrawl 推出创业公司专项福利:最高 3 万美元额度 — devdigest · 2026-08-27
- 深度报道:AI 正在购买破产公司的数据“遗产” — rvp · 2026-08-27
- Antirez:高预填速度让模型感知强十倍 — antirez · 2026-08-27
- 博伦智汇获千万级天使融资,推万卡异构算力调度架构 — 智东西 · 2026-08-27