GLM 5.3 Flash 惊艳:180 tok/s 且支持视觉
Sentdex · x · 2026-08-28
Sentdex 测试了即将发布的 GLM 5.3 Flash 版本,对其表现印象深刻。该模型在原生精度下可达 180 tok/s 的推理速度,且并发扩展性极佳。此外,该版本已支持视觉功能。Sentdex 表示,除非完整版 5.3 带来更强的视觉支持,否则可能会持续使用 Flash 版本。
所属事件:GLM-5.3 Flash 实测刷屏:一线性能、美分级成本(7 条相关)→
「模型」频道最新
- Google 一周更新:Gemini 3.5 Transcribe 与 Omni 1.1 Flash 领衔 — GoogleAI · 2026-08-28
- MiniMax H3 被发现能读懂国际音标,带口音对白更精准 — afinalsin · 2026-08-28
- Ollama 上线智谱 GLM-5.3-Flash:18B 激活参数、1M 上下文 — ollama · 2026-08-28
- zai-org/GLM-5.3 仓库现身 Hugging Face,聊天模板已流出 — kimmonismus · 2026-08-28
- 用户吐槽大模型仍不主动:明显下一步也不去做 — iruletheworldmo · 2026-08-28
- 金融 MoE 模型 Ling-3.0-flash-Fin 免费一月,人审边界成焦点 — Designer_Mouse_6109 · 2026-08-28