智谱发布 GLM-5.3-Flash:对标 GPT-4o mini,推理速度提升 50%
Philpax · hn · 2026-08-26
智谱 AI 发布 GLM-5.3-Flash 模型,主打低成本与高性能。该模型在保持高性能的同时显著降低推理成本,推理速度较上一代提升 50%。官方称其性能对标 GPT-4o mini,支持 128K 上下文,定价为 0.1 元 / 百万 Tokens。
「模型」频道最新
- Qwen-Next-Flash 模型性能与硬件需求讨论 — No-Orchid-6159 · 2026-08-27
- 智谱GLM-5.3模型权重将于明日发布 — serige · 2026-08-27
- TokenSpeed 首日支持 Qwen 3.8 Flash Next — Alibaba_Qwen · 2026-08-27
- AI 互相对话时的创造力远超面对用户时的表现 — nabeelqu · 2026-08-27
- Claude Code 新版本体积缩减 45% — jarredsumner · 2026-08-27
- OpenRouter 榜单:真金白银的消耗数据优于自媒体吹嘘 — sujingshen · 2026-08-27