双 DGX Spark 实测:GLM-5.3-Flash 写作与视觉胜过 DeepSeek-V4-Flash
kuhunaxeyive · reddit · 2026-09-03
作者在两台 Asus Ascent GX10(约等于 2× DGX Spark)上对比了 DeepSeek-V4-Flash-0731(官方权重)与 GLM-5.3-Flash(RedHatAI 的 NVFP4 量化版),并征求其他人的选择与经验。
GLM 的优势:更快得出结论且往往更准;非中英文写作明显更好;提取文本要点能力更强;视觉能力出色——DeepSeek 的 Vision-Exp 视觉输入被限制在 384 token,图像模糊到无法做真实 OCR;基准成绩更高;幻觉显著更少——文书工作无法像代码那样「测试再改进」,必须靠一次成稿的低幻觉率,这是作者的决胜因素。
DeepSeek 的优势:官方原版权重(心理上更稳);token 生成速度更快,但得到最终结果并不更快。
核心痛点:GLM 目前没有能在 2× DGX Spark 上运行的官方权重版本,作者只能继续调优量化版以消除 artifact。
「Infra」频道最新
- 实地探访里士满 240MW AI 数据中心:噪音意外安静 — AndyMasley · 2026-09-03
- Carmack 重提 Rotovator:动量交换缆绳或成太空数据中心低成本入轨方案 — ID_AA_Carmack · 2026-09-03
- Jeff Dean 2007 年幻灯片流出:数据中心硬件故障实录 — SumitGup · 2026-09-03
- 谷歌 Hot Chips 发布第八代 TPU:一年两款芯片,推理训练分开设计 — firstadopter · 2026-09-03
- 数据中心耗水是迷思?现代机房多用闭路冷却,用水仅如写字楼 — GlenBradley · 2026-09-03
- 推理工程吃香:vLLM/SGLang 搭副本加缓存路由核心配方 — GabGarrett · 2026-09-03