GLM 5.3「Flash」内部曝光,网友推测并非小模型
teortaxesTex · x · 2026-08-21
有用户发帖称智谱 GLM 5.3 "Flash" 已在内部被 spotted。teortaxesTex 对此提出两点质疑:一是其速度对 Flash 级小模型来说偏慢(不过考虑到 100T 算力承诺,也可能是在高 batch size 下运行);二是其知识水平似乎并不落后于 5.3 正式版。
他推测:如果该模型参数量小于 740B,那么智谱对 DeepSeek(以及 Kimi)的超越幅度已经大到「不好笑了」。(注:均为未证实的内部爆料与个人推测。)
「模型」频道最新
- o1 能精准修复渲染管线中视觉相关的 Bug — teortaxesTex · 2026-08-21
- OpenRouter 现神秘模型 Ox Alph,网友猜测来自中国 — Neosinic · 2026-08-21
- Claude 模型输出偶现中文字符混入现象 — springrod · 2026-08-21
- 智谱 GLM 新模型评测遭质疑,模型规模并非智能关键 — teortaxesTex · 2026-08-21
- 为何人们认为 Grok 模型会开放完整思维链 — teortaxesTex · 2026-08-21
- 实测 Qwen 3.8 本地跑分:3-9% 题目因推理死循环降分 — on_line187 · 2026-08-21