智谱GLM-5.3-Flash发布:MIT开源,百万上下文
ramagetime · x · 2026-08-27
智谱Z.ai发布GLM-5.3-Flash模型。该模型为320B参数(稀疏化,Active 18B),原代号Ox Alpha,宣称在国产芯片上运行。
核心特点:
- 高性能与低价:实测输入成本$0.15/1M tokens,输出$0.50/1M tokens,缓存输入仅$0.03,极具竞争力。
- 长上下文与多模态:原生支持1M token上下文窗口及多模态。
- 完全开源:采用MIT许可证,权重及代码全面开放。
该模型被视为在成本与性能平衡上的新标杆。
所属事件:智谱开源 GLM-5.3-Flash:低价高能登顶性价比前沿(39 条相关)→
「模型」频道最新
- AI 进入青春期:小模型在特定领域击败大模型 — DhruvBatra_ · 2026-08-27
- TerminalBench 深度评测:GPT-5.6 领跑,多模型降级 — abeirami · 2026-08-27
- 流式转录对比:Gemini 3.5 Live 首响快于 GPT Live 且更准 — ArtificialAnlys · 2026-08-27
- 双 DGX Spark 跑通 Qwen3.8-Flash-Next — NVIDIAAI · 2026-08-27
- LLM 排行榜现新榜首,性能显著超越前代 — jonathan_wilke · 2026-08-27
- Yutori 掌门谈 Agent 上网:多数网站永远不会有 API,像素进出才是正解 — DhruvBatra_ · 2026-08-27