网友用双 V100 玩起 93GB 的 GLM 5.3 Flash,解码约 20 t/s
lxfater · x · 2026-10-06
有人在 cheapest 的 Claude Pro 计划之外抢先本地跑起了疑似 GLM 5.3 Flash 的模型(尚未官方确认,转发者称其也能跑通)。
- 模型文件 93.1GB,是目前最小的版本,推测为 MoE 架构(晒出了专家分布位置作为证据)
- 暂不支持 MTP,解码速度约 20 tokens/s
- 硬件门槛极低:2x Tesla V100 32GB + 至强 E5-2690 V4 + 32GB DDR4 四通道 + NVMe 3.0
- 使用了定制版推理引擎 Strata,作者称会继续优化并最终开源发布
「模型」频道最新
- Mistral 拆解大规模 RL 训练:3000 张 GPU 日产 330 亿 token — sophiamyang · 2026-10-06
- ValsAI 榜单:Mistral Large 4 登顶开源模型 HLAB,综合排第 9 — daniel_mac8 · 2026-10-06
- ParseBench 曝 OCR 模型需读取不可见文本,评测标准引质疑 — IgorCarron · 2026-10-06
- Mistral Large 4 预览持续变强,RL 训练仍在跑,本月内开放 — qtnx_ · 2026-10-06
- 一张图半美分:博主一美元出头批量生成 200 多张图试风格 — Angaisb_ · 2026-10-06
- Mistral 发布新一代旗舰 Mistral Large 4,代号 Le Chonk — j-bu · 2026-10-06